- Primary 'vllm' entry for easy /model vllm usage - Uses model from the rtx6000 deployment - Kept existing qwen-vllm, rtx6000-vllm, and rtx6000-brain for compatibility