Motor de Flujos de Trabajo de IA
La innovación central de DuRT reside en su arquitectura modular de flujos de trabajo. En lugar de utilizar herramientas aisladas, DuRT te permite diseñar y ejecutar secuencias automatizadas que combinan captura de audio, reconocimiento de voz, inteligencia de LLMs, síntesis de locución y exportación de archivos.
Los 6 Pasos Estándar del Flujo de Trabajo
[ 1. Entrada de Medios ] ➔ [ 2. Reconocimiento ASR ] ➔ [ 3. Procesamiento LLM ] ➔ [ 4. Voz TTS ] ➔ [ 5. Exportar Archivos ]| Tipo de Paso | Icono | Función Principal |
|---|---|---|
RealtimeASR | 🎙️ | Captura transmisiones de audio del micrófono o del sistema en tiempo real |
MediaTranscription | 📁 | Procesa archivos de audio/video o URLs con diarización y marcas de tiempo |
SubtitleInput | 📝 | Importa subtítulos existentes (.srt/.vtt) o tareas previas para procesar con IA |
LLMProcess | 🤖 | Corrección, traducción, resumen o segmentación semántica mediante IA |
TextToSpeech | 🗣️ | Sintetiza locuciones de audio a partir de texto transcrito o corregido |
ExportArtifact | 💾 | Guarda automáticamente subtítulos formateados, audios o registros en el disco |
Centro de Plantillas (Workflow Hub)
DuRT incluye plantillas preconfiguradas para los escenarios más habituales:
- Actas de Reuniones en Vivo: Realtime ASR ➔ Subtítulos en Vivo ➔ Resumen con LLM ➔ Guardar en Markdown.
- Canal de Localización de Video: Media Transcription ➔ Traducción con LLM ➔ Doblaje TTS ➔ Exportar SRT Bilingüe.
- Limpieza de Podcasts: Archivo de Audio ➔ Marcas de Tiempo ➔ Eliminación de Muletillas con LLM ➔ Exportar Texto Limpio.
Creador de Flujos Personalizados
Puedes modificar las plantillas existentes o construir tus propios pipelines desde cero:
- Fija tus flujos de trabajo favoritos en la fila superior del panel principal.
- Selecciona de forma independiente qué motor impulsa cada paso (por ejemplo, Apple Speech para ASR + DeepSeek para LLM + OpenAI para TTS).
- Guarda y comparte configuraciones con tu equipo.
