安装
从 ollama.com 下载安装包。以后台服务运行,自动检测 NVIDIA 显卡,无需单独装 CUDA toolkit。
powershell
# Download from https://ollama.com/download/windows
# Or winget:
winget install Ollama.Ollama
# Verify service
ollama --version
ollama list何时改用 WSL
快速对话和 Open WebUI 用原生版即可。需要 llama.cpp 自定义编译、ExLlamaV2 或精细 CUDA 控制时改用 WSL2。
text
Native Windows Ollama:
✓ One-click install
✓ NVIDIA GPU acceleration
✓ OpenAI-compatible API at :11434
Use WSL2 instead for:
→ ExLlamaV2 / EXL2 quants
→ Custom llama.cpp flags
→ vLLM / TabbyAPI相关指南
部署指南仅供学习参考。每个模型均有独立许可协议 — 下载或部署前请阅读 Hugging Face 官方模型卡。