MetaActualFicha verificadaVerificado 31 ago 2026

Llama 4 Scout

Modelo multimodal de pesos abiertos de Meta optimizado para trabajar con contextos de hasta diez millones de tokens y despliegues eficientes.

Evaluación pendiente

Resumen

¿Para qué elegir Llama 4 Scout?

Lo mejor

  • Contexto de hasta 10M de tokens y arquitectura MoE con 17B de parámetros activos.
  • Puede ejecutarse en una sola GPU H100 según Meta y admite adaptación a distintos proveedores.

A tener en cuenta

  • La licencia Llama 4 Community License no es una licencia OSI y tiene condiciones propias de uso y distribución.
  • El coste no es único: depende de la GPU, cuantización, servidor y proveedor de inferencia.

La ficha técnica está verificada, pero todavía no hay una evaluación comparable de IA Versus para convertirla en una puntuación o ranking.

Ficha técnica · agosto 2026

La versión exacta importa.

ID en la APILlama-4-Scout-17B-16E-Instruct
Lanzamiento5 abr 2025
Corte de conocimientoago 2024
Corte de entrenamientoago 2024
Ventana de contexto10M
Salida máximaConsultar fuente
Acceso a los pesosAbiertos
LicenciaLlama 4 Community License (licencia propia; no OSI)
Modalidades de entrada

Texto · Imagen

Modalidades de salida

Texto · Código

Disponibilidad

Meta · Hugging Face · Kaggle · Proveedores de inferencia · Autohospedado

Cobertura de datos

Lo que esta ficha puede demostrar hoy.

EstadoVerificado
Fuentes vinculadas2
Campos técnicos publicados4/7
Última actualización31 ago 2026

La cobertura mide la trazabilidad de la ficha, no la calidad del modelo. Las puntuaciones y rankings requieren evidencia comparable adicional.

Rendimiento preliminar

Cinco señales, no una nota mágica.

quality
0
programación
0
value
0
speed
0
community
0

Datos piloto para validar la experiencia. Antes de producción, cada valor se vinculará a su fuente, snapshot y metodología.

Precio API orientativo

Coste separado de la calidad.

EntradaConsultar fuentepor 1M tokens
SalidaConsultar fuentepor 1M tokens
Entrada en cachéConsultar fuentepor 1M tokens
Contexto10Mtokens publicados

El precio por token no equivale al coste por tarea. Para compararlo bien también guardaremos tokens de razonamiento, caché, herramientas, reintentos, latencia y tasa de éxito.

Compatibilidad técnica

Qué admite esta configuración exacta.

Texto Imagen Código Razonamiento Open weights
MultimodalConsultar fuente
Uso de herramientasLimitadoConsultar fuente
Salida estructuradaLimitadoConsultar fuente
Despliegue localConsultar fuente
Fine-tuningLimitadoConsultar fuente

Alternativas comparables

Compara antes de decidir.

Procedencia

Cada dato debe poder rastrearse.

Los datos del proveedor describen especificaciones, precios y disponibilidad. Las puntuaciones de rendimiento se guardan por separado para que una afirmación comercial nunca se convierta automáticamente en una valoración.

Leer metodología completa →