gcloud-lab/infrastructure/gpus/base
sirius0xdev 5c61d600b0 fix(keda): simplify HTTPScaledObject to valid schema fields only
- Removed cooldownPeriod, scaledownPeriod, paths (all undeclared in http.keda.sh/v1alpha1 CRD)
- Kept pollingInterval:10 for responsiveness + min:0 replicas for true scale-to-zero
- Cleaned both rtx6000 and a100 configs for consistency

Dry-run should now succeed. Scale behavior preserved via polling + low targetPendingRequests (defaults work well for vLLM).
2026-04-29 04:54:49 +00:00
..
keda-gpu-scaling fix(keda): simplify HTTPScaledObject to valid schema fields only 2026-04-29 04:54:49 +00:00
vllm-servers feat: optimize RTX6000 vLLM KEDA scaling 2026-04-29 04:12:36 +00:00