メディアファイル&URL 文字起こし
長時間の録音ファイル、インタビュー音声、会議の録画、Web 上のオンライン動画などを、構造化された高精度のタイムライン字幕へと素早く変換します。
インポート方法
1. ローカルメディアファイル
- 1 つまたは複数の音声・動画ファイルをドラッグ&ドロップするだけで即座にインポート。
- 対応フォーマット:
.mp3,.wav,.m4a,.flac,.aac,.ogg,.mp4,.mov,.mkv,.webm,.aviなど。 - バックグラウンドでの複数タスク並列一括処理に対応。
2. Web リンクおよびダイレクト URL
- 主要な動画共有サイトのリンクや、
.mp3/.mp4などのメディア直リンクの貼り付けに対応。 - 音声データの自動ストリーミング解析と高速抽出を実行。
高度な文字起こし機能
単語レベルのタイムスタンプ (Word-level Timestamps)
- 単語ごと・1文字ごと のミリ秒単位の開始・終了タイムスタンプを出力。
- カラオケ風の字幕ハイライト、動画編集時の正確なカット位置決め、単語単位のアニメーション字幕に最適です。
話者分離 (Speaker Diarization)
- 発言者の声紋特徴を自動でクラスタリングし、話者を識別(
Speaker 0,Speaker 1,Speaker 2など)。 - 教師なしクラスタリング:話者の音声サンプルを事前に登録しておく必要はありません。
- 複数人が参加する座談会、対談インタビュー、ポッドキャストなどの書き起こしに最適です。
字幕エクスポート形式
- SRT (
.srt):業界標準の字幕フォーマット。Final Cut Pro、Premiere Pro、DaVinci Resolve、CapCut 等と完全に互換。 - WebVTT (
.vtt):HTML5 Web プレーヤー標準の字幕形式。 - プレーンテキスト (
.txt):タイムコードを除去した読みやすいテキスト原稿。 - JSON (
.json):単語レベルのタイムスタンプや話者メタデータを含む構造化データ。
