Commit graph

328 commits

Author SHA1 Message Date
sirius0xdev
518127c711
Merge pull request #17 from sirius0xdev/fix/vllm-mistral-regex
fix: enforce mistral tokenizer mode
2026-04-18 16:11:01 -04:00
sirius0xdev
de475b3073
Merge pull request #16 from sirius0xdev/feat/vllm-pvc-cache
feat: attach persistent volume claim to vLLM to cache weights
2026-04-18 16:10:48 -04:00
SiriusClaw
0f5d0b17e5 fix: enforce mistral tokenizer mode to bypass regex corruption bug 2026-04-18 20:09:35 +00:00
SiriusClaw
9b7fc44ab2 feat: attach persistent volume claim to vLLM to cache HuggingFace weights 2026-04-18 20:07:30 +00:00
sirius0xdev
f2472307cf
Merge pull request #15 from sirius0xdev/fix/vllm-dtype-auto
fix: set vLLM dtype to auto to stop weight corruption
2026-04-18 15:57:11 -04:00
SiriusClaw
576ba503b0 fix: set vLLM dtype to auto to resolve weight casting corruption 2026-04-18 19:55:55 +00:00
sirius0xdev
bdf2e1d1a4
Merge pull request #14 from sirius0xdev/fix/vllm-trust-remote-code-2
fix: adjust memory parameters to stop gibberish output
2026-04-18 15:40:22 -04:00
SiriusClaw
7826ff0398 fix: adjust max-model-len and memory utilization for Venice 2026-04-18 19:35:20 +00:00
sirius0xdev
aa40f87885
Merge pull request #13 from sirius0xdev/fix/vllm-trust-remote-code
fix: add trust-remote-code to vLLM args
2026-04-18 15:08:07 -04:00
SiriusClaw
bd6416e6a6 fix: add trust-remote-code to vLLM args for mistral architecture 2026-04-18 19:01:53 +00:00
sirius0xdev
890fe55a1f
Merge pull request #12 from sirius0xdev/fix/proxy-bot-gibberish
fix: adjust sampling parameters to prevent model gibberish
2026-04-18 14:55:27 -04:00
SiriusClaw
771f920d73 fix: adjust sampling parameters to prevent model gibberish/hallucination 2026-04-18 18:54:02 +00:00
sirius0xdev
589e5daab0
Merge pull request #11 from sirius0xdev/feat/uncensored-proxy-bot
feat: deploy raw vLLM Telegram proxy bot
2026-04-18 14:47:43 -04:00
SiriusClaw
5b2b472768 feat: deploy raw vLLM Telegram proxy bot 2026-04-18 18:46:20 +00:00
sirius0xdev
44290af92f
Merge pull request #10 from sirius0xdev/feat/vllm-dolphin-24b-venice
fix: switch to Dolphin-Mistral-24B-Venice-Edition
2026-04-18 14:14:43 -04:00
SiriusClaw
24a512e99d fix: switch to Dolphin-Mistral-24B-Venice-Edition 2026-04-18 18:12:34 +00:00
sirius0xdev
0df3e39d8a
Merge pull request #8 from sirius0xdev/feat/vllm-dolphin-72b-awq
feat: upgrade brain to uncensored Dolphin Qwen2 72B AWQ
2026-04-18 13:59:02 -04:00
sirius0xdev
31c6e532c7
Merge pull request #7 from sirius0xdev/feat/vllm-model-name-fix
fix: switch to official Qwen2.5 32B Instruct model
2026-04-18 13:57:59 -04:00
SiriusClaw
f8bc8973a1 feat: upgrade brain to uncensored Dolphin Qwen2 72B AWQ 2026-04-18 17:57:32 +00:00
SiriusClaw
5560d2b4af fix: switch to official Qwen2.5 32B Instruct model due to missing dolphin repo 2026-04-18 17:55:00 +00:00
SiriusClaw
4c70794302 feat: add gemini fallback for when a100 spot node is preempted 2026-04-18 17:52:18 +00:00
sirius0xdev
413e0ceb3d
Merge pull request #6 from sirius0xdev/feat/brain-transplant-config
feat: wire OpenClaw config to internal vLLM A100 brain
2026-04-18 13:48:05 -04:00
SiriusClaw
9051c033c4 feat: wire openclaw config to internal vllm a100 brain 2026-04-18 17:46:32 +00:00
sirius0xdev
df0e4edda7
Merge pull request #5 from sirius0xdev/fix/vllm-model-name
fix: correct huggingface model identifier for vLLM
2026-04-18 13:26:25 -04:00
SiriusClaw
1623ccb6e5 fix: correct huggingface model identifier for dolphin 32b and remove awq requirement for a100 2026-04-18 17:22:37 +00:00
sirius0xdev
9967b4b39d
Merge pull request #4 from sirius0xdev/feat/switch-to-a100
refactor: migrate vLLM brain to A100 80GB node pool
2026-04-18 12:54:28 -04:00
SiriusClaw
b7b69195d0 refactor: migrate vLLM brain to A100 80GB node pool 2026-04-18 16:53:09 +00:00
sirius0xdev
8b466d2b1c
Merge pull request #3 from sirius0xdev/fix/vllm-toleration-effect
fix: correct kubernetes toleration effect syntax for vLLM deployment
2026-04-18 12:09:50 -04:00
SiriusClaw
cf909206f5 fix: correct kubernetes toleration effect syntax for vLLM deployment 2026-04-18 16:05:15 +00:00
sirius0xdev
6a029b2ef2
Merge pull request #2 from sirius0xdev/feat/openclaw-vllm-brain
feat: deploy vLLM Gemma model on RTX 6000 for SiriusClaw
2026-04-18 11:28:48 -04:00
SiriusClaw
55a3e9eb28 refactor: upgrade vLLM brain to uncensored Qwen 2.5 32B AWQ 2026-04-18 15:26:19 +00:00
SiriusClaw
e68774da48 refactor: switch vLLM deployment to uncensored Dolphin-Gemma model 2026-04-18 15:09:21 +00:00
SiriusClaw
3792be4262 feat: deploy vLLM Gemma model on RTX 6000 for SiriusClaw 2026-04-18 14:28:22 +00:00
sirius0xdev
dacdc2feb7
Merge pull request #1 from sirius0xdev/feat/openclaw-pgdb
feat: add persistent database for SiriusClaw memory
2026-04-18 10:21:11 -04:00
SiriusClaw
9909d1f290 feat: add persistent database for SiriusClaw memory 2026-04-18 05:20:02 +00:00
sirius0xdev
0435560997 chamge default model 2026-04-18 04:57:24 +00:00
sirius0xdev
aed93882cb configmap 2026-04-18 04:45:33 +00:00
sirius0xdev
9048d69342 configmap 2026-04-18 04:40:46 +00:00
sirius0xdev
55c9326491 configmap 2026-04-18 04:34:29 +00:00
sirius0xdev
f9e086b698 fix syntax 2026-04-18 04:27:28 +00:00
sirius0xdev
c41714aa00 fix configmap 2026-04-18 04:21:39 +00:00
sirius0xdev
c74ea46a77 dial in openclaw 2026-04-18 04:18:31 +00:00
sirius0xdev
dd8f86d187 fix openclaw secrets 2026-04-18 03:22:01 +00:00
sirius0xdev
37490350e0 fix kustomization 2026-04-18 03:11:28 +00:00
sirius0xdev
f2a6031a83 Merge branch 'master' of github.com:sirius0xdev/gcloud-lab
Be cause i want to
2026-04-18 02:56:41 +00:00
sirius0xdev
2fa5f0cb11 add openclaw to cluster. 2026-04-18 02:56:18 +00:00
sirius0xdev
aad80ef06c
Update kustomization.yaml 2026-04-17 18:47:46 -04:00
sirius0xdev
dd353ab06a
Update kustomization.yaml 2026-04-17 08:45:44 -04:00
sirius0xdev
69bba269be change summarizer to 1 hour instead of overwhelming with 4 2026-03-31 02:35:26 +00:00
sirius0xdev
20b73fe716 l4 analyst 2026-03-31 00:32:14 +00:00