自动化 AI 工作流引擎
DuRT 最具创新的核心在于其模块化工作流流水线 (Workflow Pipeline) 架构。它将音频录制、语音识别、大语言模型处理与语音合成从孤立的工具打通为可自由编排的一键执行流水线。
6 大标准工作流步骤 (Step Types)
[ 1. 音频输入 ] ➔ [ 2. 语音 ASR ] ➔ [ 3. LLM 润色/翻译 ] ➔ [ 4. TTS 配音 ] ➔ [ 5. 成果导出 ]| 步骤类型 | 图标 | 职责与能力 |
|---|---|---|
RealtimeASR | 🎙️ | 实时麦克风与系统音频采集并输出实时流式字幕 |
MediaTranscription | 📁 | 本地文件或网络直链媒体转录,支持词级时间戳与说话人分离 |
SubtitleInput | 📝 | 导入既有字幕文件(.srt/.vtt)或历史任务,交由下游 AI 继续加工 |
LLMProcess | 🤖 | 调用大模型执行智能校对、翻译、断句切片、摘要总结等 |
TextToSpeech | 🗣️ | 多角色 AI 音色合成,将转录或翻译文本转换为新语音配音 |
ExportArtifact | 💾 | 自动将字幕、文本或音频伴奏保存至指定路径 |
模板中心 (Workflow Hub)
DuRT 内置了覆盖日常工作流的高频预设模板:
- 实时会议纪要流:实时字幕 ➔ AI 智能会议摘要 ➔ 自动导出 Markdown 文档。
- 视频出海双语配音流:视频转录 ➔ 多语言字幕翻译 ➔ AI 角色配音 ➔ 导出双语字幕与配音音频。
- 播客口误清洗流:音频转录(词级时间戳) ➔ LLM 口语语气词剔除 ➔ 导出纯净精校文稿。
自定义工作流搭建 (Workflow Builder)
- 自由增删、调整步骤节点顺序。
- 独立配置每个节点的执行引擎(如使用 Apple 语音识别进行 ASR,配合 DeepSeek 进行校对,OpenAI 进行 TTS)。
- 一键置顶高频工作流至 Dashboard 首屏。
