Skip to content

Guía Universal de Entrenamiento de Modelos TTS y Preparación de Datasets

Bienvenido a una guía práctica para preparar datasets de voz, entrenar o ajustar modelos personalizados de Text-to-Speech, ejecutar inferencia y empaquetar modelos para reutilizarlos.

Empieza aquí

Sigue este flujo en orden si estás iniciando un proyecto nuevo:

  1. Prepara tu dataset
  2. Configura el entorno de entrenamiento
  3. Entrena o ajusta el modelo
  4. Genera voz mediante inferencia
  5. Empaqueta y comparte el modelo
  6. Resuelve problemas y encuentra recursos

Elige tu camino

La guía intenta ser independiente del framework siempre que sea posible. Se centra en decisiones y comprobaciones que se aplican a las herramientas TTS modernas.

Usa el selector de idioma de la cabecera para cambiar entre las traducciones disponibles. Las contribuciones y las nuevas traducciones se explican en la Guía de Traducción.