システムの内部音声リアルタイム字幕、高精度ファイル文字起こし、単語レベルのタイムスタンプ、話者分離、AI 自動推敲パイプライン。

クリエイター、語学学習者、パワーユーザー向けに設計
低遅延ミーティング字幕から長尺動画の一括字幕生成まで、あらゆるシーンをカバー。
ScreenCaptureKit でシステム内部音声やマイクを直接キャプチャ。半透明フローティングウィンドウ、AEC エコーキャンセラー、二言語対照表示に対応。
ローカルの動画/音声ファイルをドラッグ&ドロップ、または動画サイトの配信 URL を貼り付けるだけ。GPU 高速並列処理で素早く文字起こし。
ミリ秒単位の正確な単語タイムスタンプと、話者識別(Speaker 0 / Speaker 1)に対応。インタビューや会議録に最適。
音声認識(ASR)、LLM による推敲/翻訳/要約、TTS 音声合成をワンクリックで実行可能なテンプレートとして連携。
Apple macOS 標準のオンデバイス音声認識に対応し、ネット接続なしでも利用可能。自前 Ollama / OneASR との連携でデータは 100% ローカル保持。
OpenAI、Claude、DeepSeek、OneASR、クラウド API を自前の API キーで直接利用。マージンなしの従量課金。
直感的なパイプライン、無限のワークフロー
DuRT は複雑な音声処理と LLM 機能を 6 つの標準ステップにモジュール化。
システム音声、マイク、ファイル、または Web URL
Apple 音声認識、OneASR ゲートウェイ、OpenAI Whisper
校正、多言語翻訳、文分割、要約生成
マルチボイス AI 音声読み上げ&速度調整
SRT、WebVTT、JSON タイムスタンプ、MP3 音声
DuRT をダウンロードして、Apple Silicon ネイティブのスピードと高精度な AI ワークフローをご体験ください。