Modelo nativamente multimodal de tipo mezcla de expertos, con 17.000 millones de parámetros activos y 16 expertos.
¿Por qué importa? Según Meta, cabe en una sola GPU NVIDIA H100 y ofrece una ventana de contexto de 10 millones de tokens, la mayor del sector en su lanzamiento.
Descarga en llama.com y Hugging Face; disponible en Meta AI y proveedores de nube. Se lanzó junto a Llama 4 Maverick.
Contexto de 10 millones de tokens. Entrada de texto e imagen.