OpenAI
GPT-5.6 Sol
Modelo generalista de alta capacidad, orientado a trabajos complejos, herramientas y flujos de razonamiento.
Catálogo versionado
Cada ficha identifica modelo, familia, acceso, capacidades y fecha de actualización. El catálogo crecerá automáticamente cada lunes.
OpenAI
Modelo generalista de alta capacidad, orientado a trabajos complejos, herramientas y flujos de razonamiento.
OpenAI
Variante equilibrada de GPT-5.6 para combinar razonamiento, herramientas y coste en flujos profesionales cotidianos.
OpenAI
Variante de GPT-5.6 orientada a cargas de alto volumen en las que el coste por tarea es una restricción principal.
Anthropic
Modelo Sonnet de Anthropic para programación, uso de herramientas y trabajo agéntico, con precio introductorio vigente hasta el 31 de agosto de 2026.
Anthropic
Modelo de frontera de Anthropic para razonamiento exigente, agentes de largo recorrido y trabajo con contexto amplio.
Anthropic
Modelo rápido y económico de Anthropic para respuestas interactivas, procesamiento de alto volumen y subagentes.
Anthropic
Modelo insignia de Anthropic para razonamiento profundo, código y trabajo prolongado con contexto.
Anthropic
Modelo de Anthropic para razonamiento, trabajo autónomo y programación agéntica con contextos de hasta un millón de tokens.
Alternativa multimodal con una ventana de contexto amplia y buena integración en el ecosistema de Google.
DeepSeek
Modelo centrado en razonamiento con un posicionamiento de coste agresivo para tareas técnicas.
Alibaba Cloud
Familia especializada en programación con opciones de API y despliegue controlado.
Mistral AI
Modelo generalista multimodal de pesos abiertos. La ficha conserva los datos comerciales y técnicos publicados por el proveedor.
Modelo Flash de Google para código, razonamiento multimodal y flujos agénticos de varios pasos.
Modelo multimodal de baja latencia de Google para subagentes, extracción y procesamiento de documentos a gran escala.
Modelo estable de Google optimizado para tareas agénticas, programación y flujos multimodales de largo recorrido.
Mistral AI
Modelo multimodal de frontera de Mistral, orientado a uso agéntico y programación con pesos disponibles.
Mistral AI
Modelo híbrido de Mistral que reúne instrucciones, razonamiento y código en un modelo eficiente de pesos abiertos.
Modelo preview de Google para resolución de problemas complejos, ingeniería de software y flujos agénticos con herramientas.
DeepSeek
Modelo de DeepSeek con modos thinking y non-thinking, diseñado para alto volumen y compatible con interfaces OpenAI y Anthropic.
DeepSeek
Variante Pro de DeepSeek V4 para tareas de razonamiento y agentes que necesitan más capacidad manteniendo una tarifa competitiva.
Alibaba Cloud
Modelo MoE de Qwen para programación agéntica, uso de herramientas y tareas de repositorio con pesos abiertos.
DeepSeek
Versión experimental de DeepSeek V4 Flash con entrada de imagen para documentos, capturas y agentes multimodales.
Meta
Modelo multimodal de pesos abiertos de Meta optimizado para trabajar con contextos de hasta diez millones de tokens y despliegues eficientes.
Meta
Modelo multimodal de pesos abiertos de Meta para razonamiento, código y agentes, con 17B de parámetros activos y 400B totales.
Mistral AI
Modelo compacto multimodal de Mistral para ejecutar en local, en edge o mediante la API con una tarifa baja y predecible.
Mistral AI
Modelo multimodal de 8B parámetros de Mistral para asistentes locales, documentos y automatizaciones con contexto largo.
Mistral AI
Modelo multimodal de 14B parámetros de Mistral para código, agentes y recuperación de documentos con despliegue flexible.
Modelo de imagen de Gemini orientado a baja latencia y coste para generación y edición de alto volumen.
Modelo generalista de imagen de Gemini para generación, edición, referencias visuales y flujos creativos iterativos.
Modelo de imagen de Gemini para tareas visuales complejas, control creativo y consistencia de marca según la documentación oficial.
Modelo conversacional de vídeo de Gemini para generar y editar clips a partir de texto e imágenes mediante iteraciones en lenguaje natural.
Modelo de vídeo de Google con audio nativo y controles para extensión de escena, último fotograma y dirección basada en imágenes.