Ollama 让在本地运行大模型变得极其简单,一条命令即可拉取并运行 Kimi、GLM、MiniMax、DeepSeek、Qwen、Gemma 等主流开源模型。它自动管理模型缓存与下载,支持多模型并发切换,并对外提供 OpenAI 兼容的 API 接口,方便直接接入各类应用与智能体框架,是个人开发者和企业搭建本地推理能力最顺手的入口。工具完全开源,源代码公开,可自由部署与二次开发,团队能根据自身需求深度定制,无需向第三方厂商支付授权费用,长期使用成本极低。
大模型部署
Ollama
本地一条命令运行 LLM 的命令行工具
免费开源支持中文