Ollama —— 本地大语言模型
Ollama 让您可以在 Mac 上直接运行开源大语言模型。无 API 费用,无需注册账号,数据永远不会离开您的设备。
NOTE
Ollama 在 Apple Silicon(M1/M2/M3/M4)Mac 上性能最佳;Intel Mac 也可以使用。模型完全离线运行。
什么是 Ollama?
Ollama 是一款免费的开源工具,用于在本地管理和运行大语言模型。它提供与 OpenAI API 格式兼容的 HTTP 接口,DuRT 可以直接连接。您可以把它理解为一个私有的、完全本地的 AI 服务。
第一步 —— 安装 Ollama
推荐使用 Homebrew 安装:
bash
brew install ollama也可以从 ollama.com/download 下载 macOS 应用程序。
安装后,启动 Ollama 服务:
bash
ollama serveTIP
如果您安装的是 macOS 应用版,Ollama 会自动在菜单栏启动,无需手动运行 ollama serve。
第二步 —— 拉取模型
使用 ollama pull 命令下载模型,例如:
bash
# 综合能力强的通用模型(约 2 GB)
ollama pull llama3.2
# 多语言模型,对中文/日文/韩文支持出色(约 5 GB)
ollama pull qwen2.5
# 欧洲语言能力强,响应快速(约 7 GB)
ollama pull mistral-nemo查看已下载的所有模型:
bash
ollama listNOTE
模型文件存储在 ~/.ollama/models,拉取大模型前请确保磁盘空间充足。
第三步 —— 在 DuRT 中添加 Ollama 服务
- 打开 DuRT,进入 设置 → 服务。
- 点击 + 添加服务,选择 Ollama。
- 将 Base URL 设置为:
http://localhost:11434 - 在 模型名称 中填写与
ollama list中完全一致的名称(如llama3.2、qwen2.5)。 - API Key 字段留空 —— Ollama 默认无需认证。
- 点击保存。
TIP
可以在 DuRT 中添加多个 Ollama 服务(每个对应一个模型),并在使用时自由切换。
推荐模型
| 模型 | 大小 | 适用场景 |
|---|---|---|
llama3.2 | 约 2 GB | 通用任务、英文处理、快速响应 |
qwen2.5 | 约 5 GB | 多语言(尤其是中文)、推理任务 |
mistral-nemo | 约 7 GB | 欧洲语言、指令遵循 |
llama3.2:1b | 约 1 GB | 极速响应、低内存占用、简单任务 |
TIP
如果不确定选哪个,从 llama3.2 开始 —— 体积小、速度快,胜任大多数日常任务。
隐私与本地运行
- 数据零上传 —— 所有推理均在本地 CPU/GPU 上完成。
- 无需账号 —— 无需注册、无 API Key、无任何服务条款约束。
- 离线可用 —— 模型下载完成后无需网络连接即可使用。
- 永久免费 —— 无用量限制,无计费。
IMPORTANT
性能取决于 Mac 的内存和芯片。若模型大小超过可用内存,将因内存交换而变慢。8 GB 内存适合约 4 GB 以内的模型;运行 7B 及以上参数的模型建议 16 GB 以上内存。
