Skip to content

よくある質問 (FAQ) ​

DuRT の日常的なご利用や設定に関して、よく寄せられる質問とその解決方法をまとめています。


1. 権限と音声キャプチャ ​

Q: リアルタイム字幕を開始してもテキストが表示されません(音声を認識しません)。 ​

  • macOS の システム設定 ➔ プライバシーとセキュリティ ➔ 画面とシステムオーディオ録音 で DuRT が許可されているか確認してください。
  • 音声を再生しているアプリ(Safari、Chrome など)がミュートになっていないか確認してください。
  • 権限を初めて許可した直後の場合、DuRT を一度完全に終了(⌘ + Q)して再起動してください。

Q: 仮想オーディオドライバや特別な拡張機能のインストールは必要ですか? ​

  • 一切不要です。 DuRT は Apple 公式の最新フレームワーク ScreenCaptureKit および CoreAudio を使用して構築されており、ドライバの追加なしで安全・クリーンに動作します。

2. 認識エンジンとパフォーマンス ​

Q: Apple 音声認識はオフラインで利用できますか? ​

  • はい、利用可能です。macOS のシステム設定で対象言語の音声認識モデルをダウンロードしておけば、インターネット接続なしで完全オンデバイスでの文字起こしが可能です。通信量も消費しません。

Q: より高い認識精度やマイナー言語の対応が必要な場合はどうすればよいですか? ​

  • OneASR 統合ゲートウェイ または OpenAI Whisper API の連携をおすすめします。長文ファイル文字起こしやワークフローにおいて、高精度な多言語認識、単語レベルのタイムスタンプ、話者分離を活用できます。

3. 字幕とワークフロー ​

Q: 単語レベルのタイムスタンプを含む字幕を出力するにはどうすればよいですか? ​

  • メディア文字起こしステップで 単語レベルのタイムスタンプ (Word-level Timestamps) をオンにし、エクスポート時に .json または高精度な .srt を選択してください。

Q: ワークフロー内で独自の LLM プロンプトを自由にカスタマイズできますか? ​

  • はい!LLM 処理 ステップにおいて、任意のプロンプトを直接入力したり、保存済みのプロンプト(誤字修正、多言語翻訳、会議要約、文分割など)を選択して適用できます。

4. アカウントと利用料金 ​

Q: DuRT の利用に料金はかかりますか? ​

  • DuRT の基本アプリ機能および macOS 内蔵の Apple 音声認識は完全無料でご利用いただけます。
  • サードパーティのクラウド LLM サービス(OpenAI、DeepSeek など)を利用する場合は、ご自身の API Key を使用するため、サービス提供元への正規従量料金のみが発生します。DuRT による仲介手数料は一切ありません。

Released under the MIT License.