Texto e imagen en el mismo hilo
Combina imágenes y texto dentro de una sola conversación para analizar capturas y gráficos.
Llama 4 Maverick es el modelo Llama 4 de Meta lanzado en abril de 2025 para comprender texto e imágenes en un mismo hilo, con un millón de tokens de contexto. Frente a Llama 3.x, amplía la multimodalidad y el contexto largo, y permite descargar sus pesos bajo licencia para evaluación. Está más orientado a tareas generales de imagen y texto que a los agents de mayor duración. Puedes usarlo en iMini Agent.
Comprensión conjunta de imagen y texto, un millón de tokens y pesos descargables.
Combina imágenes y texto dentro de una sola conversación para analizar capturas y gráficos.
Mantiene documentos extensos y conversaciones de muchos turnos en un mismo hilo.
Frente a Scout, Maverick ofrece más capacidad para tareas generales y exigentes de imagen y texto.
Permite investigación y evaluación bajo la Llama 4 Community License; también puedes probarlo en iMini.
Resultados oficiales de Llama 4 Maverick sobre arquitectura, contexto largo y código.



Llama 4 Maverick encaja con stacks de pesos abiertos y tareas multimodales generales.
Para explicar, resumir o reescribir contenido a partir de imágenes y texto.
Para procesar materiales largos dentro de un mismo hilo.
Para evaluar Llama 4 frente a otros stacks mientras lo pruebas online en iMini.
Tres opciones con diferencias entre multimodalidad de pesos abiertos y flagships cerrados para agents.
| Criterio | Llama 4 Maverick | GPT-5.6 Sol | Claude Opus 5 |
|---|---|---|---|
| Contexto | 1M tokens | 1M tokens | 1M tokens |
| Razonamiento | Multimodal general con pesos abiertos | Máxima profundidad OpenAI | Razonamiento profundo Claude |
| Código / agents | Código general y multimodal | Código de largo plazo OpenAI | Código de largo plazo Claude |
| Herramientas de larga duración | Menos centrado en agents ultralargos | Agents de máxima profundidad | Agents multipaso sólidos |
| Velocidad | Uso general | Prioriza profundidad | Prioriza finalización |
| Preferible cuando | Necesitas imagen, texto y pesos abiertos | Buscas los trabajos OpenAI más pesados | Trabajas en el stack Claude |
Cuota gratis, nombres, especificaciones y capacidad para agents de larga duración.
Un millón de tokens con texto e imagen para comprensión multimodal y comparación de pesos.
Abrir Llama 4 MaverickNo necesitas una clave API de Meta.