Skip to content

メディアファイル&URL 文字起こし ​

長時間の録音ファイル、インタビュー音声、会議の録画、Web 上のオンライン動画などを、構造化された高精度のタイムライン字幕へと素早く変換します。


インポート方法 ​

1. ローカルメディアファイル ​

  • 1 つまたは複数の音声・動画ファイルをドラッグ&ドロップするだけで即座にインポート。
  • 対応フォーマット:.mp3, .wav, .m4a, .flac, .aac, .ogg, .mp4, .mov, .mkv, .webm, .avi など。
  • バックグラウンドでの複数タスク並列一括処理に対応。

2. Web リンクおよびダイレクト URL ​

  • 主要な動画共有サイトのリンクや、.mp3/.mp4 などのメディア直リンクの貼り付けに対応。
  • 音声データの自動ストリーミング解析と高速抽出を実行。

高度な文字起こし機能 ​

単語レベルのタイムスタンプ (Word-level Timestamps) ​

  • 単語ごと・1文字ごと のミリ秒単位の開始・終了タイムスタンプを出力。
  • カラオケ風の字幕ハイライト、動画編集時の正確なカット位置決め、単語単位のアニメーション字幕に最適です。

話者分離 (Speaker Diarization) ​

  • 発言者の声紋特徴を自動でクラスタリングし、話者を識別(Speaker 0, Speaker 1, Speaker 2 など)。
  • 教師なしクラスタリング:話者の音声サンプルを事前に登録しておく必要はありません。
  • 複数人が参加する座談会、対談インタビュー、ポッドキャストなどの書き起こしに最適です。

字幕エクスポート形式 ​

  • SRT (.srt):業界標準の字幕フォーマット。Final Cut Pro、Premiere Pro、DaVinci Resolve、CapCut 等と完全に互換。
  • WebVTT (.vtt):HTML5 Web プレーヤー標準の字幕形式。
  • プレーンテキスト (.txt):タイムコードを除去した読みやすいテキスト原稿。
  • JSON (.json):単語レベルのタイムスタンプや話者メタデータを含む構造化データ。

Released under the MIT License.