Les Étapes du Flux de Travail
Le moteur de flux de travail de DuRT vous permet d'enchaîner jusqu'à 6 types d'étapes dans un pipeline automatisé : de la capture ou transcription de fichiers jusqu'à l'exportation finale, en passant par le traitement par IA. Chaque étape est modulaire et configurable.
NOTE
Les étapes s'exécutent de façon séquentielle. La sortie de chaque étape est automatiquement transmise comme entrée à la suivante.
Étape 1 — RealtimeASR
Objectif : Capturer et transcrire l'audio en direct en temps réel, depuis votre microphone ou depuis le son système de votre Mac.
Fonctionnement
DuRT s'appuie sur ScreenCaptureKit pour intercepter l'audio système, vous permettant de transcrire des visioconférences, des cours en ligne ou des podcasts sans configuration matérielle complexe. L'entrée micro permet la transcription de vos propres prises de parole.
Options Principales
| Option | Description |
|---|---|
| Source d'Entrée | Audio Système (ScreenCaptureKit) ou Microphone |
| AEC (Annulation d'Écho) | Supprime la réinjection micro lorsque les haut-parleurs sont allumés |
| Langue | Définissez la langue parlée pour optimiser la précision |
| Moteur | Choisissez le moteur de reconnaissance vocale (Apple Speech, etc.) |
Étape 2 — MediaTranscription
Objectif : Transcrire des fichiers audio/vidéo préenregistrés ou des flux en ligne distants.
Sources Prises en Charge
Fichiers locaux : MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, AVI, WEBM, etc.
URLs distantes :
- Liens de plateformes vidéo et listes de lecture
- URLs directes vers des flux audio/vidéo (
.mp3,.mp4,.m3u8, etc.)
Options Principales
| Option | Description |
|---|---|
| Source | Emplacement du fichier local ou URL distante |
| Horodatage au Mot Près | Attribue un repère temporel précis à chaque mot pour un sous-titrage optimal |
| Diarisation des Locuteurs | Distingue et étiquette les différents intervenants (Locuteur 1, Locuteur 2…) |
| Langue | Définissez la langue parlée ou utilisez la détection automatique |
| Moteur | Sélectionnez le moteur ASR |
Étape 3 — SubtitleInput
Objectif : Injecter du texte ou des sous-titres existants dans le flux sans devoir transcrire un fichier audio depuis le départ.
Méthodes d'Entrée
| Méthode | Description |
|---|---|
| Importer un fichier SRT | Charge un fichier de sous-titres .srt depuis votre disque |
| Référencer une tâche passée | Réutilise la transcription issue d'une tâche précédente |
| Saisir ou coller du texte | Tapez ou collez directement du texte dans l'éditeur |
Étape 4 — LLMProcess
Objectif : Appliquer un modèle linguistique d'IA pour relire, traduire, segmenter ou résumer le texte transcrit.
Modes Disponibles
| Mode | Fonction |
|---|---|
| Relecture (Proofreading) | Corrige la ponctuation, la grammaire et les erreurs phonétiques |
| Traduction (Translation) | Traduit le texte dans la langue cible de votre choix |
| Découpage en Phrases (Sentence Splitting) | Découpe un long bloc de texte en phrases rythmées pour les sous-titres |
| Résumé (Summary) | Synthétise le contenu en un compte rendu concis avec points clés |
Étape 5 — TextToSpeech
Objectif : Convertir le texte traité ou traduit en audio parlé avec une voix naturelle.
Options Principales
| Option | Description |
|---|---|
| Voix | Choisissez une voix prédéfinie ou personnalisée |
| Vitesse | Ajustez la cadence d'élocution (ex. 0.8× pour un apprentissage, 1.2× pour un rythme rapide) |
| Langue | Assurez-vous qu'elle corresponde à la langue du texte |
| Fournisseur TTS | Sélectionnez le moteur (OpenAI TTS, voix système macOS, etc.) |
Étape 6 — ExportArtifact
Objectif : Enregistrer les fichiers générés dans les formats de votre choix.
Formats de Sous-titres
- SRT (
.srt) : Format universel pour logiciels de montage et lecteurs vidéo. - VTT (
.vtt) : Idéal pour le web et les lecteurs HTML5. - TXT (
.txt) : Transcription en texte brut sans horodatage.
Formats Audio
- AAC (
.aac) : Haute qualité avec compression efficace. - MP3 (
.mp3) : Compatibilité maximale.
