Modelo abierto de texto a voz en inglés de 500 millones de parámetros, con clonación de voz y control de la intensidad emocional.
¿Por qué importa? Fue uno de los modelos de voz abiertos más usados, comparado por Resemble con sistemas cerrados; incluye marca de agua para detectar audio sintético.
Pesos abiertos en Hugging Face y GitHub (licencia MIT).