Qué está publicado por Google
El modelo estable se identifica como gemini-3.5-flash. Acepta texto, imágenes, vídeo, audio y PDF, y devuelve texto. Google documenta thinking, function calling, salidas estructuradas, búsqueda, URL context, file search y ejecución de código.
El contexto de entrada es de 1.048.576 tokens y el máximo de salida es de 65.536. Estos límites son del endpoint documentado; no deben extrapolarse automáticamente a todos los productos que usan la marca Gemini.
Precio y coste real
La tarifa estándar publicada es de 1,50 dólares por millón de tokens de entrada y 9 dólares de salida. El caché de contexto tiene un precio de 0,15 dólares por millón, además del almacenamiento horario cuando corresponda.
En tareas con thinking, los tokens de razonamiento forman parte de la salida facturable. Para comparar con otro modelo, calcula el coste por respuesta aceptada y registra el nivel de esfuerzo, el número de llamadas a herramientas y las repeticiones.
¿Para quién tiene sentido?
Encaja especialmente en ciclos agénticos, programación iterativa, documentos multimodales y procesos que aprovechan herramientas de Google. Para un flujo corto y de alto volumen puede convenir un modelo más ligero; para código crítico, la decisión debe confirmarse con una prueba de tu repositorio.
La ficha de IA Versus separa estos datos oficiales de cualquier puntuación de rendimiento. La ausencia de una nota propia no significa que el modelo sea peor: significa que todavía no publicamos una evaluación reproducible.
Siguiente paso