Skip to content
macOS ネイティブ音声 AI & 字幕ワークフロー

Mac のための 次世代 音声認識 & AI ワークフロー

システムの内部音声リアルタイム字幕、高精度ファイル文字起こし、単語レベルのタイムスタンプ、話者分離、AI 自動推敲パイプライン。

DuRT—音声認識 & AI パイプライン
DuRT リアルタイム字幕と AI ワークフロー画面

コア機能

クリエイター、語学学習者、パワーユーザー向けに設計

低遅延ミーティング字幕から長尺動画の一括字幕生成まで、あらゆるシーンをカバー。

リアルタイム字幕&内部音声録音

ScreenCaptureKit でシステム内部音声やマイクを直接キャプチャ。半透明フローティングウィンドウ、AEC エコーキャンセラー、二言語対照表示に対応。

メディアファイル&URL 文字起こし

ローカルの動画/音声ファイルをドラッグ&ドロップ、または動画サイトの配信 URL を貼り付けるだけ。GPU 高速並列処理で素早く文字起こし。

単語レベルのタイムスタンプ&話者分離

ミリ秒単位の正確な単語タイムスタンプと、話者識別(Speaker 0 / Speaker 1)に対応。インタビューや会議録に最適。

自動化 AI パイプライン

音声認識(ASR)、LLM による推敲/翻訳/要約、TTS 音声合成をワンクリックで実行可能なテンプレートとして連携。

プライバシー最優先&完全オフライン

Apple macOS 標準のオンデバイス音声認識に対応し、ネット接続なしでも利用可能。自前 Ollama / OneASR との連携でデータは 100% ローカル保持。

BYOK 自由なマルチエンジン連携

OpenAI、Claude、DeepSeek、OneASR、クラウド API を自前の API キーで直接利用。マージンなしの従量課金。

モジュール設計

直感的なパイプライン、無限のワークフロー

DuRT は複雑な音声処理と LLM 機能を 6 つの標準ステップにモジュール化。

1

音声ソース

システム音声、マイク、ファイル、または Web URL

2

ASR 音声認識

Apple 音声認識、OneASR ゲートウェイ、OpenAI Whisper

3

LLM 推敲&翻訳

校正、多言語翻訳、文分割、要約生成

4

TTS 音声合成

マルチボイス AI 音声読み上げ&速度調整

5

成果物エクスポート

SRT、WebVTT、JSON タイムスタンプ、MP3 音声

FAQ

よくある質問

macOS の音声&字幕作業を今すぐアップグレード

DuRT をダウンロードして、Apple Silicon ネイティブのスピードと高精度な AI ワークフローをご体験ください。

macOS 13.0 (Ventura) 以降が必要です。Apple Silicon (M1/M2/M3/M4) および Intel Mac に最適化。

Released under the MIT License.