From 5622e6c49c216261db5b0c78ffff115bda7d5834 Mon Sep 17 00:00:00 2001 From: sirius0xdev Date: Tue, 28 Apr 2026 23:55:29 -0400 Subject: [PATCH] Update rtx6000-vllm.yaml --- .../gpus/base/vllm-servers/rtx6000-vllm.yaml | 14 +++++++------- 1 file changed, 7 insertions(+), 7 deletions(-) diff --git a/infrastructure/gpus/base/vllm-servers/rtx6000-vllm.yaml b/infrastructure/gpus/base/vllm-servers/rtx6000-vllm.yaml index 1894334..2e60c16 100644 --- a/infrastructure/gpus/base/vllm-servers/rtx6000-vllm.yaml +++ b/infrastructure/gpus/base/vllm-servers/rtx6000-vllm.yaml @@ -5,16 +5,16 @@ metadata: name: openclaw-brain-vllm namespace: customer1 labels: - app: openclaw-brain + app: rtx6000-brain spec: replicas: 1 selector: matchLabels: - app: openclaw-brain + app: rtx6000-brain template: metadata: labels: - app: openclaw-brain + app: rtx6000-brain spec: nodeSelector: cloud.google.com/gke-accelerator: "nvidia-rtx-pro-6000" @@ -57,7 +57,7 @@ spec: limits: nvidia.com/gpu: 1 memory: "100Gi" - cpu: "16" + requests: nvidia.com/gpu: 1 memory: "80Gi" @@ -120,7 +120,7 @@ metadata: spec: accessModes: - ReadWriteOnce - storageClassName: hyperdisk-balanced # ← Change to your StorageClass name + storageClassName: hyperdisk-balanced resources: requests: storage: 100Gi @@ -129,11 +129,11 @@ spec: apiVersion: v1 kind: Service metadata: - name: openclaw-brain-service + name: rtx6000-brain-service namespace: customer1 spec: selector: - app: openclaw-brain + app: rtx6000-brain ports: - protocol: TCP port: 8000