Skip to content

自動化 AI ワークフローエンジン ​

DuRT の革新的なコアは、モジュール型ワークフローパイプライン(Workflow Pipeline) アーキテクチャにあります。音声録音、音声認識、LLM による言語処理、音声合成といった独立したツール同士を連携させ、ワンクリックで実行可能な自動化パイプラインを自由に構築できます。


6 つの標準ワークフローステップ (Step Types) ​

[ 1. 音声入力 ] ➔ [ 2. 音声認識 (ASR) ] ➔ [ 3. LLM 推敲/翻訳 ] ➔ [ 4. TTS 吹き替え ] ➔ [ 5. 成果物出力 ]
ステップ種別アイコン役割と機能
RealtimeASR🎙️マイクやシステム内部音声をリアルタイムに取得し、ストリーミング字幕を出力
MediaTranscription📁ローカルファイルや Web メディアの文字起こし(単語タイムスタンプ・話者分離対応)
SubtitleInput📝既存の字幕ファイル(.srt/.vtt)や過去のタスク履歴をインポートし、後続の AI 処理へ渡す
LLMProcess🤖大規模言語モデルを呼び出し、スマート校正、翻訳、文分割、要約などを実行
TextToSpeech🗣️多彩な AI 音声でテキストを読み上げ、新規の吹き替え音声を生成
ExportArtifact💾字幕、テキスト原稿、または生成音声を指定したフォルダへ自動保存

テンプレートハブ (Workflow Hub) ​

DuRT には日常的なユースケースをカバーする豊富なプリセットテンプレートが用意されています:

  1. リアルタイム議事録パイプライン:リアルタイム字幕 ➔ AI 会議要約 ➔ Markdown 形式で自動エクスポート。
  2. 多言語動画吹き替えパイプライン:動画文字起こし ➔ 多言語字幕翻訳 ➔ AI ナレーション生成 ➔ 二言語字幕と音声ファイルの書き出し。
  3. ポッドキャスト校正パイプライン:音声文字起こし(単語タイムスタンプ) ➔ LLM フィラー除去 ➔ クリーンなテキスト原稿のエクスポート。

カスタムワークフローの作成 (Workflow Builder) ​

  • 各ステップノードの追加、削除、順序の並べ替えが自由自在。
  • 各ノードの実行エンジンを個別に指定可能(例:ASR には Apple 音声認識、校正には DeepSeek、TTS には OpenAI を使用)。
  • 頻繁に使うお気に入りのワークフローをダッシュボードのトップ画面に固定可能。

Released under the MIT License.