fix: trigger KEDA scale-up on 1 request instead of 3

- Wake script handles cold start, so scale immediately on first request
- Reduces latency for /wake command and manual requests
This commit is contained in:
Sirius Claw 2026-04-22 17:22:22 +00:00
parent 240620c3a4
commit 9673b76fc7

View file

@ -18,4 +18,4 @@ spec:
metadata: metadata:
path: "/v1/models" path: "/v1/models"
host: "openclaw-brain-service.customer1.svc.cluster.local" host: "openclaw-brain-service.customer1.svc.cluster.local"
requestCount: "3" # Scale up when 3+ requests pending requestCount: "1" # Scale up on 1+ request (wake script handles cold start)