Guida Universale all'Addestramento di Modelli TTS e alla Preparazione dei Dataset¶
Benvenuto in una guida pratica per preparare dataset vocali, addestrare o fare fine-tuning di modelli Text-to-Speech personalizzati, eseguire l'inferenza e preparare i modelli per il riutilizzo.
Inizia qui¶
Segui il flusso nell'ordine indicato se stai iniziando un nuovo progetto:
- Prepara il tuo dataset
- Configura l'ambiente di addestramento
- Addestra o fai fine-tuning del modello
- Genera parlato con l'inferenza
- Prepara e condividi il modello
- Risolvi i problemi e trova risorse
Scegli il tuo percorso¶
- Hai audio grezzo senza trascrizioni pulite: inizia dalla Preparazione dei Dati.
- Hai già coppie audio-testo pulite: continua con la Configurazione dell'Addestramento.
- Hai un checkpoint addestrato: vai all'Inferenza.
- Hai un modello pronto per la distribuzione: leggi Packaging e Condivisione.
La guida è indipendente dal framework quando possibile. Si concentra sulle decisioni e sui controlli che si applicano agli strumenti TTS moderni.
Usa il selettore della lingua nell'intestazione per passare tra le traduzioni disponibili. I contributi e le nuove traduzioni sono descritti nella Guida alla Traduzione.