Skip to content

Ollama —— 本地大语言模型 ​

Ollama 让您可以在 Mac 上直接运行开源大语言模型。无 API 费用,无需注册账号,数据永远不会离开您的设备。

NOTE

Ollama 在 Apple Silicon(M1/M2/M3/M4)Mac 上性能最佳;Intel Mac 也可以使用。模型完全离线运行。


什么是 Ollama? ​

Ollama 是一款免费的开源工具,用于在本地管理和运行大语言模型。它提供与 OpenAI API 格式兼容的 HTTP 接口,DuRT 可以直接连接。您可以把它理解为一个私有的、完全本地的 AI 服务。


第一步 —— 安装 Ollama ​

推荐使用 Homebrew 安装:

bash
brew install ollama

也可以从 ollama.com/download 下载 macOS 应用程序。

安装后,启动 Ollama 服务:

bash
ollama serve

TIP

如果您安装的是 macOS 应用版,Ollama 会自动在菜单栏启动,无需手动运行 ollama serve。


第二步 —— 拉取模型 ​

使用 ollama pull 命令下载模型,例如:

bash
# 综合能力强的通用模型(约 2 GB)
ollama pull llama3.2

# 多语言模型,对中文/日文/韩文支持出色(约 5 GB)
ollama pull qwen2.5

# 欧洲语言能力强,响应快速(约 7 GB)
ollama pull mistral-nemo

查看已下载的所有模型:

bash
ollama list

NOTE

模型文件存储在 ~/.ollama/models,拉取大模型前请确保磁盘空间充足。


第三步 —— 在 DuRT 中添加 Ollama 服务 ​

  1. 打开 DuRT,进入 设置 → 服务。
  2. 点击 + 添加服务,选择 Ollama。
  3. 将 Base URL 设置为:
    http://localhost:11434
  4. 在 模型名称 中填写与 ollama list 中完全一致的名称(如 llama3.2、qwen2.5)。
  5. API Key 字段留空 —— Ollama 默认无需认证。
  6. 点击保存。

TIP

可以在 DuRT 中添加多个 Ollama 服务(每个对应一个模型),并在使用时自由切换。


推荐模型 ​

模型大小适用场景
llama3.2约 2 GB通用任务、英文处理、快速响应
qwen2.5约 5 GB多语言(尤其是中文)、推理任务
mistral-nemo约 7 GB欧洲语言、指令遵循
llama3.2:1b约 1 GB极速响应、低内存占用、简单任务

TIP

如果不确定选哪个,从 llama3.2 开始 —— 体积小、速度快,胜任大多数日常任务。


隐私与本地运行 ​

  • 数据零上传 —— 所有推理均在本地 CPU/GPU 上完成。
  • 无需账号 —— 无需注册、无 API Key、无任何服务条款约束。
  • 离线可用 —— 模型下载完成后无需网络连接即可使用。
  • 永久免费 —— 无用量限制,无计费。

IMPORTANT

性能取决于 Mac 的内存和芯片。若模型大小超过可用内存,将因内存交换而变慢。8 GB 内存适合约 4 GB 以内的模型;运行 7B 及以上参数的模型建议 16 GB 以上内存。

Released under the MIT License.