Ollama
本地运行大语言模型的工具,提供类似 Docker 的体验,一键拉取和运行模型。
- 仓库:ollama/ollama
- 星标:约 178.9k (2026-08)
- 语言:Go
- 平台:macOS、Linux、Windows
核心能力
- 一键运行:
ollama run qwen2.5就能跑起来 - 模型库丰富:支持 Qwen、DeepSeek、Llama、Gemma、Mistral 等主流开源模型
- OpenAI 兼容 API:提供 REST API,兼容 OpenAI 格式
- 多模态支持:支持视觉模型
- 自定义模型:通过 Modelfile 定制模型
优势
- 上手最简单,几乎零配置
- 性能优化好,支持 GPU 加速
- 模型生态丰富,更新快
- 资源占用合理
劣势
- 生产环境功能不如 vLLM 完善
- 企业级特性(认证、监控)需要自建
- 不支持分布式推理
适用场景
- 个人开发者本地跑模型
- 小团队内部轻量部署
- Copilot MVP 验证阶段
更多对比见 AI Copilot 整体方案调研 和 vLLM