Ollama —— ローカル大規模言語モデル
Ollama を使うと、お使いの Mac 上でオープンソースの大規模言語モデル(LLM)を直接実行できます。API 利用料は一切不要で、アカウント登録も不要。データが Mac の外に出ることは決してありません。
NOTE
Ollama は Apple Silicon(M1/M2/M3/M4)搭載 Mac で最高のパフォーマンスを発揮します。Intel Mac でも動作可能です。モデルは完全にオフラインで動作します。
Ollama とは?
Ollama は、ローカル環境で LLM を手軽に管理・実行できる無料のオープンソースツールです。OpenAI API 互換のローカル HTTP エンドポイントを提供するため、DuRT から簡単に接続できます。完全にプライベートな自前 AI サーバーとして機能します。
ステップ 1 — Ollama のインストール
Homebrew を使用したインストールをおすすめします:
brew install ollamaまたは、ollama.com/download から macOS アプリをダウンロードしてインストールすることも可能です。
インストール後、サービスを起動します:
ollama serveTIP
macOS アプリ版をインストールした場合、メニューバー常駐アプリとして自動起動するため、ターミナルで ollama serve を実行する必要はありません。
ステップ 2 — モデルのダウンロード
ターミナルで ollama pull コマンドを実行して、お好みのモデルをダウンロードします:
# バランスに優れた汎用モデル(約 2 GB)
ollama pull llama3.2
# 日本語・多言語に非常に強いモデル(約 5 GB)
ollama pull qwen2.5
# ヨーロッパ系言語に強く指示追従性の高いモデル(約 7 GB)
ollama pull mistral-nemoダウンロード済みモデルの確認:
ollama listNOTE
モデルファイルは ~/.ollama/models に保存されます。ダウンロード前にディスク容量をご確認ください。
ステップ 3 — DuRT に Ollama サービスを追加する
- DuRT を開き、設定 → サービス に移動します。
- + 追加 をクリックし、Ollama を選択します。
- Base URL に以下を設定します:
http://localhost:11434 - モデル名 に
ollama listで確認した名前(例:qwen2.5、llama3.2)を正確に入力します。 - API Key 欄は空欄のままで構いません(Ollama は認証不要です)。
- 保存 をクリックします。
TIP
DuRT に異なるモデルを設定した複数の Ollama サービスを追加しておき、ワークフローごとに使い分けることも可能です。
おすすめのモデル一覧
| モデル | サイズ | 特徴と適した用途 |
|---|---|---|
qwen2.5 | 約 5 GB | 日本語・多言語の処理、校正、翻訳に最適 |
llama3.2 | 約 2 GB | 軽量で高速、一般的な英語処理や要約 |
mistral-nemo | 約 7 GB | 高い推論力と厳密なフォーマット遵守 |
llama3.2:1b | 約 1 GB | 超軽量・省メモリ、シンプルなタスク向け |
プライバシーとローカル動作のメリット
- データ流出ゼロ —— すべての推論処理はお手元の Mac の CPU/GPU/Neural Engine 上で完結します。
- アカウント・登録不要 —— クレジットカード登録や API キーの発行は不要です。
- 完全オフライン対応 —— モデルのダウンロード後は、インターネット接続のない機内やセキュリティルームでも利用できます。
- 利用料永久無料 —— トークン制限や月額費用を気にせず何度でも実行できます。
IMPORTANT
動作速度は Mac のメモリ容量とチップ性能に依存します。モデルサイズが搭載メモリを超えるとスワップが発生して低速になります。8GB メモリの Mac では 3B 前後(約 2〜3GB)のモデル、7B 以上のモデルを快適に動かすには 16GB 以上のメモリを推奨します。
