OneASR 統合ゲートウェイ連携
OneASR は、DuRT のために開発された高性能オープンソース音声認識ゲートウェイです。プライベート環境へのセルフホストや、チーム・社内ローカルネットワークでの共有に対応しています。
OneASR を導入するメリット
- マルチモデルの統合:Faster-Whisper、FireRedASR、SenseVoice、Paraformer などの最先端オープンソース音声認識モデルを 1 つの標準 API に集約。
- 大容量ファイルの非同期バックグラウンド処理:2GB を超える長尺動画・音声ファイルをローカルネットワーク上の GPU サーバーへ送信して非同期処理し、完了後に DuRT へ自動通知。
- 高精度な VAD 音声区間検出と話者分離:Silero-VAD によるスマートな音声分割と、PyAnnote による高精度な話者クラスタリングを内包。
クイックデプロイと接続設定
サーバーまたは Mac のターミナルで OneASR を起動します:
bashgit clone https://github.com/codeAndxv/OneASR.git cd OneASR pip install -r requirements.txt uvicorn app.main:app --host 0.0.0.0 --port 8000DuRT でサービスを追加します:
- サービス種別:
OneASR - サービス URL:
http://localhost:8000(またはサーバーのローカル IP) - API Key:
sk-oneasr-xxx(config.yamlで設定した認証キー)
- サービス種別:
ファイル文字起こしやリアルタイム字幕ステップで、エンジンとして OneASR を選択するだけで利用可能です。
