工作流程配方
工作流程配方是針對常見任務預先設計好的步驟組合。以下每個配方都列出了需要串聯的具體步驟,以及獲得最佳效果的關鍵配置建議。
NOTE
在 DuRT 中,打開工作流程面板,按下方順序新增步驟並完成配置,最後點擊執行即可執行整條管線。
配方 1:快速檔案轉錄 → 匯出 SRT
適用場景: 您有一個本機音訊/視訊檔案,希望盡快取得字幕檔案。
步驟組合
- MediaTranscription(媒體檔案轉錄)
- ExportArtifact(匯出)
關鍵配置
- MediaTranscription → 來源: 選擇本機檔案(MP3、WAV、MP4、MKV 等)。
- MediaTranscription → 字詞級時間戳記: ✅ 開啟——產生準確 SRT 時間碼的必要條件。
- MediaTranscription → 語言: 明確指定說話語言,而非依賴自動偵測,以獲得最佳辨識率。
- ExportArtifact → 格式: 選擇 SRT。
TIP
若影片中有多位說話者,同時開啟說話者分離,即可在轉錄結果中區分每位發言者。
配方 2:會議錄音轉錄 + AI 總結 → 匯出 TXT
適用場景: 您錄製了一段會議,希望同時獲得乾淨的文字稿和簡潔的內容摘要,並儲存為純文字檔案。
步驟組合
- MediaTranscription(媒體檔案轉錄)
- LLMProcess(校對)
- LLMProcess(總結)
- ExportArtifact(匯出)
關鍵配置
- MediaTranscription → 說話者分離: ✅ 開啟,使每段發言歸屬到對應參與者。
- LLMProcess #1 → 模式: 設為校對(Proofreading),先修正 ASR 錯誤和標點,再進行總結。
- LLMProcess #2 → 模式: 設為總結(Summary)。
- LLMProcess #2 → 自訂提示詞: 可補充說明,例如*「重點提煉行動項目和決策結論。」*
- ExportArtifact → 格式: 選擇 TXT。
TIP
在匯出步驟中同時勾選多個格式,可一次性匯出校對後的完整文字稿和總結摘要。
配方 3:Podcast 轉錄 + 翻譯成中文 → 匯出雙語 SRT
適用場景: 您想為一個英文 Podcast 或影片加入中文字幕,或製作雙語字幕檔案進行分享。
步驟組合
- MediaTranscription(媒體檔案轉錄)
- LLMProcess(翻譯)
- ExportArtifact(匯出)
關鍵配置
- MediaTranscription → 來源: 貼上 YouTube/Podcast URL,或選擇本機檔案。
- MediaTranscription → 字詞級時間戳記: ✅ 開啟,確保字幕時間準確。
- LLMProcess → 模式: 翻譯(Translation)。
- LLMProcess → 目標語言: 繁體中文(或您需要的其他語言)。
- LLMProcess → 自訂提示詞: 新增*「保留字幕換行格式。人名和專有名詞保留原文形式。」*
- ExportArtifact → 格式: SRT(或面向網頁播放器的 VTT)。
NOTE
若需要真正的雙語 SRT(原文 + 譯文同時顯示),可在自訂提示詞中要求 LLM 將原文和譯文逐行交替輸出。
配方 4:即時字幕 → 匯出文字記錄
適用場景: 在直播活動、線上會議或課堂中即時顯示字幕,並在結束後保存完整的文字記錄。
步驟組合
- RealtimeASR(即時語音轉錄)
- ExportArtifact(匯出)
關鍵配置
- RealtimeASR → 輸入源: 線上會議選擇系統音訊(擷取所有參與者聲音);實體線下活動選擇麥克風。
- RealtimeASR → AEC 回音消除: ✅ 在使用系統音訊且揚聲器開啟時務必開啟。
- RealtimeASR → 語言: 設定說話語言。
- ExportArtifact → 格式: 純文字記錄選 TXT;需要時間戳記選 SRT。
IMPORTANT
使用系統音訊擷取前,請確認 macOS 已授予 DuRT 螢幕錄製權限(系統設定 → 隱私權與安全性 → 螢幕錄製)。
配方 5:語言學習——影片連結轉錄 + 翻譯 + TTS 配音朗讀
適用場景: 您正在學習一門外語,想要轉錄外語影片、翻譯為母語,並透過 TTS 朗讀譯文輔助練習發音和理解。
步驟組合
- MediaTranscription(媒體檔案轉錄)
- LLMProcess(翻譯)
- TextToSpeech(語音合成)
- ExportArtifact(匯出)
關鍵配置
- MediaTranscription → 來源: 貼上影片連結(YouTube 等)或選擇本機檔案。
- MediaTranscription → 字詞級時間戳記: ✅ 開啟。
- LLMProcess → 模式: 翻譯(Translation)。
- LLMProcess → 目標語言: 您的母語。
- TextToSpeech → 音色: 選擇與目標語言相符的預設音色。
- TextToSpeech → 語速: 調低至 0.8× 或 0.75×,便於學習時理解。
- ExportArtifact → 格式: MP3(音訊)+ SRT(字幕),同時匯出以便靈活使用。
TIP
聽完一遍 TTS 朗讀後,換一種不同口音或性別的音色再聽一遍,練習在不同情境下理解目標語言。
配方 6:影片配音替換——轉錄 + 翻譯 + TTS + 匯出音訊
適用場景: 您有一段影片,希望製作另一種語言的配音音軌,用於後期影片剪輯中替換原音。
步骤組合
- MediaTranscription(媒體檔案轉錄)
- LLMProcess(校對)
- LLMProcess(翻譯)
- TextToSpeech(語音合成)
- ExportArtifact(匯出)
關鍵配置
- MediaTranscription → 來源: 選擇本機影片檔案。
- MediaTranscription → 字詞級時間戳記: ✅ 開啟——精確的時間資訊有助於配音與原片剪輯點對齊。
- LLMProcess #1 → 模式: 校對(Proofreading)——在翻譯前先修正 ASR 錯誤,避免錯誤傳播。
- LLMProcess #2 → 模式: 翻譯(Translation)。
- LLMProcess #2 → 目標語言: 配音語言。
- LLMProcess #2 → 自訂提示詞: 「請以口語配音風格翻譯,保持句子長度自然,盡量與原文節奏相近。」
- TextToSpeech → 音色: 若需匹配原聲,使用音色複製;否則選擇專業預設音色。
- TextToSpeech → 語速: 適當調整以貼近原片說話節奏。
- ExportArtifact → 格式: 音軌選 AAC 或 MP3;可同時匯出 SRT 作為翻譯字幕備用。
TIP
將匯出的音訊檔案匯入影片編輯器(Final Cut Pro、DaVinci Resolve 等),將原音軌靜音後替換為新音軌,即可完成配音替換。
NOTE
使用音色複製時,請在執行工作流程前先上傳 10~30 秒的純淨目標音色錄音樣本。
