Llama 4, el nuevo gigante de Meta: más inteligente, abierto y multimodal

Llama 4 ya está aquí y promete marcar un antes y un después en la carrera por la inteligencia artificial. Meta ha anunciado tres modelos dentro de esta nueva familia: Llama 4 Scout, Llama 4 Maverick y una vista previa de Llama 4 Behemoth, el más potente jamás creado por la compañía.

Los modelos Llama 4 representan una nueva era para el ecosistema de Meta. Scout y Maverick son los primeros modelos multimodales con peso abierto, capaces de procesar texto e imágenes de forma nativa y simultánea, y están disponibles para descarga inmediata en llama.com y Hugging Face.

Dos modelos, un nuevo estándar

Llama 4 Scout, con 17.000 millones de parámetros activos y 16 expertos, es el modelo más potente de su clase. Destaca por su capacidad para manejar contextos de hasta 10 millones de tokens, una cifra nunca antes vista que abre las puertas a tareas como la resolución de grandes volúmenes de texto, razonamiento sobre extensos repositorios de código o personalización basada en actividad pasada. Su arquitectura «iRoPE», sin embeddings posicionales tradicionales, mejora la generalización en contextos largos.

Por su parte, Llama 4 Maverick también cuenta con 17.000 millones de parámetros activos pero incluye 128 expertos y 400.000 millones de parámetros totales. Supera a modelos como GPT-4o y Gemini 2.0 Flash en comprensión de texto e imágenes, razonamiento y programación, y es competitivo con DeepSeek v3.1 con menos de la mitad de los parámetros activos. Su versión de chat ha alcanzado una puntuación de 1417 en LMArena, estableciendo un nuevo referente de relación calidad-precio.

Ambos modelos han sido destilados a partir de Llama 4 Behemoth, un coloso con 288.000 millones de parámetros activos y cerca de 2 billones totales, que se perfila como uno de los modelos más inteligentes del mundo, superando a GPT-4.5, Claude Sonnet 3.7 y Gemini 2.0 Pro en múltiples benchmarks STEM como MATH-500 y GPQA Diamond.

Tecnología puntera: arquitectura MoE y fusión temprana

Llama 4 adopta una arquitectura Mixture of Experts (MoE), donde cada token activa solo una parte del modelo, lo que permite más eficiencia y menor latencia. Por ejemplo, Maverick usa capas alternas densas y MoE, en las que cada token se envía a un experto común y a uno de los 128 expertos específicos. Esto permite un uso más económico de los recursos de cómputo.

En cuanto a la capacidad multimodal, Llama 4 ha sido entrenado desde cero con fusión temprana de texto, imagen y vídeo, lo que le proporciona una comprensión más profunda y contextual de entradas visuales. Scout destaca además por su habilidad de alinear respuestas con regiones concretas de una imagen, lo que permite una interacción más precisa.

Entrenamiento y seguridad: más inteligente, más seguro

Meta ha desarrollado nuevas técnicas como MetaP, que permite ajustar automáticamente hiperparámetros clave, y ha empleado precisión FP8 para mejorar el rendimiento sin comprometer la calidad. El preentrenamiento se realizó con más de 30 billones de tokens multilingües, duplicando el volumen de datos respecto a Llama 3.

La fase de postentrenamiento ha incluido estrategias como aprendizaje por refuerzo online continuo, eliminación de datos triviales y optimización de preferencia directa. Este enfoque ha permitido equilibrar la inteligencia del modelo con su capacidad de mantener conversaciones naturales.

En cuanto a seguridad, Meta ha implementado herramientas como Llama Guard, Prompt Guard y CyberSecEval, además de introducir el sistema GOAT (Generative Offensive Agent Testing) para mejorar el red-teaming automatizado. Llama 4 también mejora en cuestiones de neutralidad política y social, reduciendo las respuestas sesgadas y las negativas ante preguntas controvertidas.

Abierto y accesible

Fiel a su apuesta por el código abierto, Meta pone a disposición de todos los desarrolladores Llama 4 Scout y Maverick, facilitando su integración en servicios en la nube, dispositivos edge y plataformas globales. Los modelos ya funcionan en aplicaciones como WhatsApp, Messenger, Instagram Direct y la web Meta.AI.

Además, Meta celebrará el próximo 29 de abril LlamaCon, un evento en el que presentará su visión futura para el ecosistema Llama.

Con Llama 4, Meta no solo eleva el listón tecnológico, sino que apuesta por un futuro más abierto, personalizado y colaborativo en la inteligencia artificial.

La imagen que ilustra esta noticia ha sido generada con Ideogram.

ChatGPT
ChatGPThttps://chatgpt.com/
En The AI Revolution News utilizamos ChatGPT para traducir y/o generar algunos textos a partir de notas de prensa oficiales. Todos estos artículos son revisados por humanos para evitar alucinaciones de la inteligencia artificial y ofrecer una información rigurosa y veraz.

Artículos relacionados

Comentarios

DEJA UNA RESPUESTA

Por favor ingrese su comentario!
Por favor ingrese su nombre aquí

Este sitio usa Akismet para reducir el spam. Aprende cómo se procesan los datos de tus comentarios.

+ Noticias