Running vLLM natively on Windows 10/11 with CUDA and an OpenAI-compatible server, no WSL or Docker, via the open-source vllm-windows-build patches and wheels.