Skip to content

Síntesis de Voz (TTS) ​

Genera locuciones de voz con IA naturales y expresivas a partir de transcripciones, subtítulos traducidos o guiones de texto personalizados.


Características ​

  • Voces Multirrol: Elige entre una variada selección de voces masculinas, femeninas y neutras con diferentes personalidades.
  • Control de Velocidad y Tono: Ajusta la velocidad de habla de 0.5x a 2.0x para una sincronización óptima con el video.
  • Doblaje y Localización: Convierte subtítulos traducidos en pistas de audio dobladas con pronunciación natural.
  • Exportación de Audio: Exporta pistas de audio independientes en formatos .mp3 o .aac de alta tasa de bits, listas para importar en Final Cut Pro o Premiere Pro.

Motores de TTS Compatibles ​

  • OpenAI TTS (tts-1, tts-1-hd con las voces alloy, echo, fable, onyx, nova, shimmer).
  • Edge TTS (Voces neuronales multilingües naturales).
  • Motores Propios / CosyVoice mediante endpoints compatibles.
  • Síntesis de Voz de Apple (Voces del sistema y Siri integradas en macOS).

Released under the MIT License.