Familia de modelos de traducción de voz: SeamlessExpressive conserva la expresión vocal, SeamlessStreaming traduce con unos dos segundos de latencia, ambos sobre SeamlessM4T v2.
¿Por qué importa? Según Meta, fue el primer sistema público que permitía comunicación expresiva entre idiomas en tiempo real.
Pesos abiertos en GitHub y Hugging Face, con demos públicas. Se anunció junto a Audiobox.