Skip to content

Ollama —— 本機大型語言模型 ​

Ollama 讓您可以在 Mac 上直接執行開源大型語言模型。無 API 費用,無需註冊帳號,資料永遠不會離開您的裝置。

NOTE

Ollama 在 Apple Silicon(M1/M2/M3/M4)Mac 上效能最佳;Intel Mac 也可以使用。模型完全離線執行。


什麼是 Ollama? ​

Ollama 是一款免費的開源工具,用於在本機管理和執行大型語言模型。它提供與 OpenAI API 格式相容的 HTTP 介面,DuRT 可以直接連線。您可以把它理解為一個私有的、完全本機的 AI 服務。


第一步 —— 安裝 Ollama ​

推薦使用 Homebrew 安裝:

bash
brew install ollama

也可以從 ollama.com/download 下載 macOS 應用程式。

安裝後,啟動 Ollama 服務:

bash
ollama serve

TIP

如果您安裝的是 macOS 應用版,Ollama 會自動在選單列啟動,無需手動執行 ollama serve。


第二步 —— 拉取模型 ​

使用 ollama pull 命令下載模型,例如:

bash
# 綜合能力強的通用模型(約 2 GB)
ollama pull llama3.2

# 多語言模型,對中文/日文/韓文支援出色(約 5 GB)
ollama pull qwen2.5

# 歐洲語言能力強,回應快速(約 7 GB)
ollama pull mistral-nemo

查看已下載的所有模型:

bash
ollama list

NOTE

模型檔案儲存在 ~/.ollama/models,拉取大模型前請確保磁碟空間充足。


第三步 —— 在 DuRT 中新增 Ollama 服務 ​

  1. 開啟 DuRT,進入 設定 → 服務。
  2. 點擊 + 新增服務,選擇 Ollama。
  3. 將 Base URL 設定為:
    http://localhost:11434
  4. 在 模型名稱 中填寫與 ollama list 中完全一致的名稱(如 llama3.2、qwen2.5)。
  5. API Key 欄位留空 —— Ollama 預設無需認證。
  6. 點擊儲存。

TIP

可以在 DuRT 中新增多個 Ollama 服務(每個對應一個模型),並在使用時自由切換。


推薦模型 ​

模型大小適用場景
llama3.2約 2 GB通用任務、英文處理、快速回應
qwen2.5約 5 GB多語言(尤其是中文)、推理任務
mistral-nemo約 7 GB歐洲語言、指令遵循
llama3.2:1b約 1 GB極速回應、低記憶體佔用、簡單任務

TIP

如果不確定選哪個,從 llama3.2 開始 —— 體積小、速度快,勝任大多數日常任務。


隱私與本機執行 ​

  • 資料零上傳 —— 所有推理均在本機 CPU/GPU 上完成。
  • 無需帳號 —— 無需註冊、無 API Key、無任何服務條款約束。
  • 離線可用 —— 模型下載完成後無需網路連線即可使用。
  • 永久免費 —— 無用量限制,無計費。

IMPORTANT

效能取決於 Mac 的記憶體和晶片。若模型大小超過可用記憶體,將因記憶體交換(Swap)而變慢。8 GB 記憶體適合約 4 GB 以內的模型;執行 7B 及以上參數的模型建議 16 GB 以上記憶體。

Released under the MIT License.