Skip to content

Les Étapes du Flux de Travail ​

Le moteur de flux de travail de DuRT vous permet d'enchaîner jusqu'à 6 types d'étapes dans un pipeline automatisé : de la capture ou transcription de fichiers jusqu'à l'exportation finale, en passant par le traitement par IA. Chaque étape est modulaire et configurable.

NOTE

Les étapes s'exécutent de façon séquentielle. La sortie de chaque étape est automatiquement transmise comme entrée à la suivante.


Étape 1 — RealtimeASR ​

Objectif : Capturer et transcrire l'audio en direct en temps réel, depuis votre microphone ou depuis le son système de votre Mac.

Fonctionnement ​

DuRT s'appuie sur ScreenCaptureKit pour intercepter l'audio système, vous permettant de transcrire des visioconférences, des cours en ligne ou des podcasts sans configuration matérielle complexe. L'entrée micro permet la transcription de vos propres prises de parole.

Options Principales ​

OptionDescription
Source d'EntréeAudio Système (ScreenCaptureKit) ou Microphone
AEC (Annulation d'Écho)Supprime la réinjection micro lorsque les haut-parleurs sont allumés
LangueDéfinissez la langue parlée pour optimiser la précision
MoteurChoisissez le moteur de reconnaissance vocale (Apple Speech, etc.)

Étape 2 — MediaTranscription ​

Objectif : Transcrire des fichiers audio/vidéo préenregistrés ou des flux en ligne distants.

Sources Prises en Charge ​

Fichiers locaux : MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, AVI, WEBM, etc.

URLs distantes :

  • Liens de plateformes vidéo et listes de lecture
  • URLs directes vers des flux audio/vidéo (.mp3, .mp4, .m3u8, etc.)

Options Principales ​

OptionDescription
SourceEmplacement du fichier local ou URL distante
Horodatage au Mot PrèsAttribue un repère temporel précis à chaque mot pour un sous-titrage optimal
Diarisation des LocuteursDistingue et étiquette les différents intervenants (Locuteur 1, Locuteur 2…)
LangueDéfinissez la langue parlée ou utilisez la détection automatique
MoteurSélectionnez le moteur ASR

Étape 3 — SubtitleInput ​

Objectif : Injecter du texte ou des sous-titres existants dans le flux sans devoir transcrire un fichier audio depuis le départ.

Méthodes d'Entrée ​

MéthodeDescription
Importer un fichier SRTCharge un fichier de sous-titres .srt depuis votre disque
Référencer une tâche passéeRéutilise la transcription issue d'une tâche précédente
Saisir ou coller du texteTapez ou collez directement du texte dans l'éditeur

Étape 4 — LLMProcess ​

Objectif : Appliquer un modèle linguistique d'IA pour relire, traduire, segmenter ou résumer le texte transcrit.

Modes Disponibles ​

ModeFonction
Relecture (Proofreading)Corrige la ponctuation, la grammaire et les erreurs phonétiques
Traduction (Translation)Traduit le texte dans la langue cible de votre choix
Découpage en Phrases (Sentence Splitting)Découpe un long bloc de texte en phrases rythmées pour les sous-titres
Résumé (Summary)Synthétise le contenu en un compte rendu concis avec points clés

Étape 5 — TextToSpeech ​

Objectif : Convertir le texte traité ou traduit en audio parlé avec une voix naturelle.

Options Principales ​

OptionDescription
VoixChoisissez une voix prédéfinie ou personnalisée
VitesseAjustez la cadence d'élocution (ex. 0.8× pour un apprentissage, 1.2× pour un rythme rapide)
LangueAssurez-vous qu'elle corresponde à la langue du texte
Fournisseur TTSSélectionnez le moteur (OpenAI TTS, voix système macOS, etc.)

Étape 6 — ExportArtifact ​

Objectif : Enregistrer les fichiers générés dans les formats de votre choix.

Formats de Sous-titres ​

  • SRT (.srt) : Format universel pour logiciels de montage et lecteurs vidéo.
  • VTT (.vtt) : Idéal pour le web et les lecteurs HTML5.
  • TXT (.txt) : Transcription en texte brut sans horodatage.

Formats Audio ​

  • AAC (.aac) : Haute qualité avec compression efficace.
  • MP3 (.mp3) : Compatibilité maximale.

Released under the MIT License.