Skip to content

Moteur de Flux de Travail d'IA ​

L'innovation centrale de DuRT repose sur son architecture de flux de travail modulaire. Plutôt que d'utiliser des outils disparates, DuRT vous permet d'agencer et d'exécuter des pipelines automatisés combinant capture audio, reconnaissance vocale, modèles d'IA, synthèse vocale et exportation de fichiers.


Les 6 Étapes Standards d'un Flux ​

[ 1. Entrée Média ] ➔ [ 2. Reconnaissance ASR ] ➔ [ 3. Traitement LLM ] ➔ [ 4. Voix TTS ] ➔ [ 5. Export de Fichiers ]
Type d'ÉtapeIcôneRôle Principal
RealtimeASR🎙️Capture en temps réel le flux audio du microphone ou du système
MediaTranscription📁Traite des fichiers audio/vidéo ou des URLs avec diarisation et horodatage
SubtitleInput📝Importe des sous-titres existants (.srt/.vtt) ou des tâches passées pour l'IA
LLMProcess🤖Relecture, traduction, résumé ou segmentation sémantique via l'IA
TextToSpeech🗣️Génère des voix off audio à partir de texte transcrit ou traduit
ExportArtifact💾Enregistre automatiquement les sous-titres, audios ou comptes rendus sur le disque

Centre de Modèles (Workflow Hub) ​

DuRT intègre des modèles prêts à l'emploi pour les cas d'usage fréquents :

  1. Compte Rendu de Réunion en Direct : Realtime ASR ➔ Sous-titres en Direct ➔ Résumé par LLM ➔ Enregistrement Markdown.
  2. Pipeline de Localisation Vidéo : Media Transcription ➔ Traduction LLM ➔ Doublage TTS ➔ Export SRT Bilingue.
  3. Nettoyage de Podcast : Fichier Audio ➔ Horodatage Précis ➔ Suppression des Hésitations par LLM ➔ Export Texte Propre.

Concepteur de Flux Personnalisés ​

Vous pouvez adapter les modèles existants ou créer vos propres pipelines sur mesure :

  • Épinglez vos flux préférés en haut du tableau de bord.
  • Définissez indépendamment le moteur qui alimente chaque étape (ex. Apple Speech pour l'ASR + DeepSeek pour le LLM + OpenAI pour le TTS).
  • Enregistrez et partagez vos configurations de flux avec votre équipe.

Released under the MIT License.