gcloud-lab/infrastructure/gpus/base/keda-gpu-scaling/keda-a100.yaml
sirius0xdev 5c61d600b0 fix(keda): simplify HTTPScaledObject to valid schema fields only
- Removed cooldownPeriod, scaledownPeriod, paths (all undeclared in http.keda.sh/v1alpha1 CRD)
- Kept pollingInterval:10 for responsiveness + min:0 replicas for true scale-to-zero
- Cleaned both rtx6000 and a100 configs for consistency

Dry-run should now succeed. Scale behavior preserved via polling + low targetPendingRequests (defaults work well for vLLM).
2026-04-29 04:54:49 +00:00

18 lines
372 B
YAML

apiVersion: http.keda.sh/v1alpha1
kind: HTTPScaledObject
metadata:
name: openclaw-brain-a100-scaling
namespace: customer1
spec:
hosts:
- a100-vllm.internal.cluster
scaleTargetRef:
name: openclaw-brain-vllm
kind: Deployment
apiVersion: apps/v1
service: openclaw-brain-service
port: 8000
replicas:
min: 0
max: 1
pollingInterval: 10