GoogleActualFicha verificadaVerificado 31 ago 2026

Gemini 3.5 Flash-Lite

Modelo multimodal de baja latencia de Google para subagentes, extracción y procesamiento de documentos a gran escala.

Evaluación pendiente

Resumen

¿Para qué elegir Gemini 3.5 Flash-Lite?

Lo mejor

  • Entrada multimodal con contexto de 1.048.576 tokens y salida de 65.536.
  • Precio orientado a cargas de alto volumen y soporte de caché, batch, function calling y structured outputs.

A tener en cuenta

  • Está optimizado para eficiencia y no sustituye a un modelo de frontera en razonamiento difícil.
  • El precio y la disponibilidad pueden diferir entre AI Studio, Vertex AI y otros planes.

La ficha técnica está verificada, pero todavía no hay una evaluación comparable de IA Versus para convertirla en una puntuación o ranking.

Ficha técnica · agosto 2026

La versión exacta importa.

ID en la APIgemini-3.5-flash-lite
Lanzamiento30 jul 2026
Corte de conocimientoConsultar fuente
Corte de entrenamientoConsultar fuente
Ventana de contexto1,05M
Salida máxima65K
Acceso a los pesosCerrados
LicenciaComercial
Modalidades de entrada

Texto · Imagen · Vídeo · Audio · PDF

Modalidades de salida

Texto

Disponibilidad

Gemini API · Google AI Studio · Vertex AI

Cobertura de datos

Lo que esta ficha puede demostrar hoy.

EstadoVerificado
Fuentes vinculadas2
Campos técnicos publicados7/7
Última actualización31 ago 2026

La cobertura mide la trazabilidad de la ficha, no la calidad del modelo. Las puntuaciones y rankings requieren evidencia comparable adicional.

Rendimiento preliminar

Cinco señales, no una nota mágica.

quality
0
programación
0
value
0
speed
0
community
0

Datos piloto para validar la experiencia. Antes de producción, cada valor se vinculará a su fuente, snapshot y metodología.

Precio API orientativo

Coste separado de la calidad.

Entrada$0.30por 1M tokens
Salida$2.50por 1M tokens
Entrada en caché$0.03por 1M tokens
Contexto1,05Mtokens publicados

El precio por token no equivale al coste por tarea. Para compararlo bien también guardaremos tokens de razonamiento, caché, herramientas, reintentos, latencia y tasa de éxito.

Compatibilidad técnica

Qué admite esta configuración exacta.

Texto Imagen Audio Vídeo PDF Herramientas
ThinkingConsultar fuente
Function callingConsultar fuente
Salida estructuradaConsultar fuente
Búsqueda y groundingConsultar fuente
Ejecución de códigoConsultar fuente
Computer useLimitadoConsultar fuente
Batch APIConsultar fuente

Alternativas comparables

Compara antes de decidir.

Procedencia

Cada dato debe poder rastrearse.

Los datos del proveedor describen especificaciones, precios y disponibilidad. Las puntuaciones de rendimiento se guardan por separado para que una afirmación comercial nunca se convierta automáticamente en una valoración.

Leer metodología completa →