Modelos de IA · 6 min

Gemini 3.5 Flash: precio, contexto y funciones en agosto de 2026.

Gemini 3.5 Flash es una de las búsquedas que ya está trayendo impresiones a IA Versus. La respuesta corta es que ofrece una ventana de contexto de 1,05 millones de tokens y salida de hasta 65K, pero la elección depende de cómo uses el razonamiento y las herramientas.

Qué está publicado por Google

El modelo estable se identifica como gemini-3.5-flash. Acepta texto, imágenes, vídeo, audio y PDF, y devuelve texto. Google documenta thinking, function calling, salidas estructuradas, búsqueda, URL context, file search y ejecución de código.

El contexto de entrada es de 1.048.576 tokens y el máximo de salida es de 65.536. Estos límites son del endpoint documentado; no deben extrapolarse automáticamente a todos los productos que usan la marca Gemini.

Precio y coste real

La tarifa estándar publicada es de 1,50 dólares por millón de tokens de entrada y 9 dólares de salida. El caché de contexto tiene un precio de 0,15 dólares por millón, además del almacenamiento horario cuando corresponda.

En tareas con thinking, los tokens de razonamiento forman parte de la salida facturable. Para comparar con otro modelo, calcula el coste por respuesta aceptada y registra el nivel de esfuerzo, el número de llamadas a herramientas y las repeticiones.

¿Para quién tiene sentido?

Encaja especialmente en ciclos agénticos, programación iterativa, documentos multimodales y procesos que aprovechan herramientas de Google. Para un flujo corto y de alto volumen puede convenir un modelo más ligero; para código crítico, la decisión debe confirmarse con una prueba de tu repositorio.

La ficha de IA Versus separa estos datos oficiales de cualquier puntuación de rendimiento. La ausencia de una nota propia no significa que el modelo sea peor: significa que todavía no publicamos una evaluación reproducible.

Siguiente paso

Lleva la guía a tu caso.