Skip to content

Motor de Flujos de Trabajo de IA ​

La innovación central de DuRT reside en su arquitectura modular de flujos de trabajo. En lugar de utilizar herramientas aisladas, DuRT te permite diseñar y ejecutar secuencias automatizadas que combinan captura de audio, reconocimiento de voz, inteligencia de LLMs, síntesis de locución y exportación de archivos.


Los 6 Pasos Estándar del Flujo de Trabajo ​

[ 1. Entrada de Medios ] ➔ [ 2. Reconocimiento ASR ] ➔ [ 3. Procesamiento LLM ] ➔ [ 4. Voz TTS ] ➔ [ 5. Exportar Archivos ]
Tipo de PasoIconoFunción Principal
RealtimeASR🎙️Captura transmisiones de audio del micrófono o del sistema en tiempo real
MediaTranscription📁Procesa archivos de audio/video o URLs con diarización y marcas de tiempo
SubtitleInput📝Importa subtítulos existentes (.srt/.vtt) o tareas previas para procesar con IA
LLMProcess🤖Corrección, traducción, resumen o segmentación semántica mediante IA
TextToSpeech🗣️Sintetiza locuciones de audio a partir de texto transcrito o corregido
ExportArtifact💾Guarda automáticamente subtítulos formateados, audios o registros en el disco

Centro de Plantillas (Workflow Hub) ​

DuRT incluye plantillas preconfiguradas para los escenarios más habituales:

  1. Actas de Reuniones en Vivo: Realtime ASR ➔ Subtítulos en Vivo ➔ Resumen con LLM ➔ Guardar en Markdown.
  2. Canal de Localización de Video: Media Transcription ➔ Traducción con LLM ➔ Doblaje TTS ➔ Exportar SRT Bilingüe.
  3. Limpieza de Podcasts: Archivo de Audio ➔ Marcas de Tiempo ➔ Eliminación de Muletillas con LLM ➔ Exportar Texto Limpio.

Creador de Flujos Personalizados ​

Puedes modificar las plantillas existentes o construir tus propios pipelines desde cero:

  • Fija tus flujos de trabajo favoritos en la fila superior del panel principal.
  • Selecciona de forma independiente qué motor impulsa cada paso (por ejemplo, Apple Speech para ASR + DeepSeek para LLM + OpenAI para TTS).
  • Guarda y comparte configuraciones con tu equipo.

Released under the MIT License.