Ollama —— 本機大型語言模型
Ollama 讓您可以在 Mac 上直接執行開源大型語言模型。無 API 費用,無需註冊帳號,資料永遠不會離開您的裝置。
NOTE
Ollama 在 Apple Silicon(M1/M2/M3/M4)Mac 上效能最佳;Intel Mac 也可以使用。模型完全離線執行。
什麼是 Ollama?
Ollama 是一款免費的開源工具,用於在本機管理和執行大型語言模型。它提供與 OpenAI API 格式相容的 HTTP 介面,DuRT 可以直接連線。您可以把它理解為一個私有的、完全本機的 AI 服務。
第一步 —— 安裝 Ollama
推薦使用 Homebrew 安裝:
bash
brew install ollama也可以從 ollama.com/download 下載 macOS 應用程式。
安裝後,啟動 Ollama 服務:
bash
ollama serveTIP
如果您安裝的是 macOS 應用版,Ollama 會自動在選單列啟動,無需手動執行 ollama serve。
第二步 —— 拉取模型
使用 ollama pull 命令下載模型,例如:
bash
# 綜合能力強的通用模型(約 2 GB)
ollama pull llama3.2
# 多語言模型,對中文/日文/韓文支援出色(約 5 GB)
ollama pull qwen2.5
# 歐洲語言能力強,回應快速(約 7 GB)
ollama pull mistral-nemo查看已下載的所有模型:
bash
ollama listNOTE
模型檔案儲存在 ~/.ollama/models,拉取大模型前請確保磁碟空間充足。
第三步 —— 在 DuRT 中新增 Ollama 服務
- 開啟 DuRT,進入 設定 → 服務。
- 點擊 + 新增服務,選擇 Ollama。
- 將 Base URL 設定為:
http://localhost:11434 - 在 模型名稱 中填寫與
ollama list中完全一致的名稱(如llama3.2、qwen2.5)。 - API Key 欄位留空 —— Ollama 預設無需認證。
- 點擊儲存。
TIP
可以在 DuRT 中新增多個 Ollama 服務(每個對應一個模型),並在使用時自由切換。
推薦模型
| 模型 | 大小 | 適用場景 |
|---|---|---|
llama3.2 | 約 2 GB | 通用任務、英文處理、快速回應 |
qwen2.5 | 約 5 GB | 多語言(尤其是中文)、推理任務 |
mistral-nemo | 約 7 GB | 歐洲語言、指令遵循 |
llama3.2:1b | 約 1 GB | 極速回應、低記憶體佔用、簡單任務 |
TIP
如果不確定選哪個,從 llama3.2 開始 —— 體積小、速度快,勝任大多數日常任務。
隱私與本機執行
- 資料零上傳 —— 所有推理均在本機 CPU/GPU 上完成。
- 無需帳號 —— 無需註冊、無 API Key、無任何服務條款約束。
- 離線可用 —— 模型下載完成後無需網路連線即可使用。
- 永久免費 —— 無用量限制,無計費。
IMPORTANT
效能取決於 Mac 的記憶體和晶片。若模型大小超過可用記憶體,將因記憶體交換(Swap)而變慢。8 GB 記憶體適合約 4 GB 以內的模型;執行 7B 及以上參數的模型建議 16 GB 以上記憶體。
