Open SourceVoce e media42k
Coqui TTS
Toolkit di deep learning per text-to-speech con oltre 1100 lingue.
Coqui TTS (la libreria TTS) è un toolkit open-source di deep learning per il text-to-speech, che fornisce modelli preaddestrati e ricette di addestramento per un'ampia gamma di architetture di sintesi vocale. Supporta sintesi multi-speaker e multilingue e la clonazione vocale, e include il modello XTTS; l'azienda originale ha chiuso ma il repository rimane un riferimento ampiamente utilizzato.
Repository
coqui-ai/TTSLinguaggio
PythonCosa ci costruiresti
- Generare parlato sintetico da testo usando voci multilingue preaddestrate
- Clonare o adattare una voce da un breve campione di riferimento per narrazioni o agenti
- Addestrare o fare fine-tuning di modelli TTS custom sui propri dati vocali
Tag
ttsvoice-cloningmultilingual