- Wake script handles cold start, so scale immediately on first request - Reduces latency for /wake command and manual requests
- Scale to 0 when idle (saves money) - 15 min cooldown before scale-down - Triggers on 3+ pending HTTP requests - Targets openclaw-brain-vllm deployment