Skip to content

OneASR 統合ゲートウェイ連携 ​

OneASR は、DuRT のために開発された高性能オープンソース音声認識ゲートウェイです。プライベート環境へのセルフホストや、チーム・社内ローカルネットワークでの共有に対応しています。


OneASR を導入するメリット ​

  • マルチモデルの統合:Faster-Whisper、FireRedASR、SenseVoice、Paraformer などの最先端オープンソース音声認識モデルを 1 つの標準 API に集約。
  • 大容量ファイルの非同期バックグラウンド処理:2GB を超える長尺動画・音声ファイルをローカルネットワーク上の GPU サーバーへ送信して非同期処理し、完了後に DuRT へ自動通知。
  • 高精度な VAD 音声区間検出と話者分離:Silero-VAD によるスマートな音声分割と、PyAnnote による高精度な話者クラスタリングを内包。

クイックデプロイと接続設定 ​

  1. サーバーまたは Mac のターミナルで OneASR を起動します:

    bash
    git clone https://github.com/codeAndxv/OneASR.git
    cd OneASR
    pip install -r requirements.txt
    uvicorn app.main:app --host 0.0.0.0 --port 8000
  2. DuRT でサービスを追加します:

    • サービス種別:OneASR
    • サービス URL:http://localhost:8000(またはサーバーのローカル IP)
    • API Key:sk-oneasr-xxx(config.yaml で設定した認証キー)
  3. ファイル文字起こしやリアルタイム字幕ステップで、エンジンとして OneASR を選択するだけで利用可能です。

Released under the MIT License.