Ollama 是一款能够在本地设备上运行大型语言模型的命令行工具,它允许用户下载并运行诸如 Llama 2、Code Llama 等多种模型,并支持用户自定义和构建自己的模型。该开源项目目前支持 macOS 和 Linux 系统,未来还将扩展到 Windows 平台。
此外,Ollama 提供了官方的 Docker 镜像,使用户能够通过 Docker 容器更便捷地部署大型语言模型,确保所有与模型的交互都在本地完成,无需将敏感数据传输到第三方服务。在 macOS 和 Linux 上,Ollama 还支持 GPU 加速,并提供了简单的命令行界面(CLI)以及用于应用程序交互的 REST API。
对于需要在本地运行和测试大语言模型的开发人员和研究人员来说,Ollama 是一个非常有用的工具,因为它无需依赖外部云服务。
Ollama 现已推出适用于 macOS 和 Windows 的 Ollama 桌面端,新增了文件处理和多模态交互功能,使用户与本地大语言模型的交互更加直观和便捷。
Ollama 安装包获取

获取 Ollama 安装包,扫码关注回复:Ollama
Ollama 支持的模型
Ollama 提供了一个模型库,用户可以根据需要选择安装并运行相应的模型,目前支持超过 40 种模型,数量还在不断增加。以下是一些可下载的开源模型示例:
| 模型 | 参数大小 | 文件大小 | 下载运行命令 |
|---|---|---|---|
| DeepSeek-R1 | 1.5B、7B、14B、32B 等 | 12-320GB | ollama run deepseek-r1 |
| Neural Chat | 7B | 4.1GB | ollama run neural-chat |
| Starling | 7B | 4.1GB | ollama run starling-lm |
| Mistral | 7B | 4.1GB | ollama run mistral |
| Llama 2 | 7B | 3.8GB | ollama run llama2 |
| Code Llama | 7B | 3.8GB | ollama run codellama |
| Llama 2 Uncensored | 7B | 3.8GB | ollama run llama2-uncensored |
| Llama 2 13B | 13B | 7.3GB | ollama run llama2:13b |
| Llama 2 70B | 70B | 39GB | ollama run llama2:70b |
| Orca Mini | 3B | 1.9GB | ollama run orca-mini |
| Vicuna | 7B | 3.8GB | ollama run vicuna |
数据统计
数据评估
关于Ollama特别声明
本站Fetei提供的Ollama都来源于网络,不保证外部链接的准确性和完整性,同时,对于该外部链接的指向,不由Fetei实际控制,在13 9 月, 2026 10:50 上午收录时,该网页上的内容,都属于合规合法,后期网页的内容如出现违规,可以直接联系网站管理员进行删除,Fetei不承担任何责任。
