TokenGate
Documentación
docs / modelos / google
Google

Gemini

La línea Flash de Gemini cubre desde lo ultraligero (Flash-Lite, para eficiencia y costo) hasta lo balanceado (3.5 / 3.6 Flash, para agentes y código). Los modelos de imagen Nano Banana (2, 2 Lite y Pro) generan y editan imagen. Visión y documentos soportados en toda la familia de texto.

RazonamientoBudget / level
Contextohasta 1M
Modalidadestexto · imagen · doc
Modelos10

Thinking budget vs. thinking level

Gemini usa dos mecanismos de razonamiento distintos según la generación, y no son intercambiables:

Gemini 2.5 — thinking budget

Control granular por cantidad exacta de tokens de razonamiento (0 a 32.768 según el modelo). 2.5 Flash-Lite puede desactivar el pensamiento del todo (thinkingBudget: 0). Por default, el "dynamic thinking" ajusta automáticamente el presupuesto según la complejidad del prompt.

Gemini 3.x — thinking level

Presets (minimal/low/medium/high) en vez de un número de tokens. Los modelos 3.x no pueden desactivar el pensamiento por completo. Los tokens de pensamiento se facturan como output.

El trade-off es el mismo en ambos esquemas: más pensamiento = más tiempo hasta el primer token de respuesta, pero razonamiento más cuidadoso. TokenGate traduce reasoning_effort a thinkingConfig.thinkingLevel en 3.x o a thinkingConfig.thinkingBudget (mapeo effort→tokens) en 2.5.

Modelos

Datos en vivo del catálogo. Tocá el nombre de un modelo para su ficha completa (precio con el toggle COP, capacidades, tramos de contexto, ejemplo).

gemini-2.5-flash-lite

Rápido / económicoRápido
gemini-2.5-flash-lite

Gemini 2.5 Flash Lite es un modelo ultraligero diseñado para máxima velocidad y eficiencia. Ideal para tareas sencillas, respuestas instantáneas y entornos de alta demanda, ofrece un rendimiento ágil y económico, optimizando...

Contexto1M tok
Salida máx.64K tok
Entrada / 1M$0.10
Salida / 1M$0.40
Razonamientolow · medium · high
Tool use / funcionesVisiónVideoDocumentosBúsqueda web
Chat generalAlto volumen / económicoBaja latencia
Ficha completa — precio en vivo, capacidades, ejemplo →

Gemini-3.1-lite

Rápido / económicoRápido
gemini-3.1-flash-lite

Gemini 3.1 Flash Lite es el modelo más eficiente y ágil de nuestra arquitectura. Optimizado para ofrecer respuestas ultrarrápidas y un consumo mínimo de recursos, es la solución ideal para aplicaciones en tiempo real, tareas...

Contexto1M tok
Salida máx.64K tok
Entrada / 1M$0.25
Salida / 1M$1.50
Razonamientolow · medium · high
Tool use / funcionesVisiónVideoDocumentosBúsqueda web
Chat generalAlto volumen / económicoBaja latencia
Ficha completa — precio en vivo, capacidades, ejemplo →

gemini-3.5-flash

BalanceadoRápido
gemini-3.5-flash

Gemini 3.5 Flash es un modelo multimodal ultrarrápido y altamente eficiente, optimizado para diversas aplicaciones empresariales en tiempo real. Ofrece un equilibrio perfecto entre rendimiento avanzado, baja latencia y sólidas...

Contexto1M tok
Salida máx.65K tok
Entrada / 1M$1.50
Salida / 1M$9.00
Razonamientominimal · medium · high
Tool use / funcionesVisiónVideoDocumentosBúsqueda web
RazonamientoAgentic / ToolsBaja latencia
Ficha completa — precio en vivo, capacidades, ejemplo →

gemini-3.5-flash-lite

Rápido / económicoRápido
gemini-3.5-flash-lite

Gemini 3.5 Flash Lite es un modelo ultraligero de Google optimizado para tareas de alta velocidad y baja complejidad. Ofrece respuestas instantáneas con un costo mínimo, siendo ideal para aplicaciones de chat simples,...

Contexto1M tok
Salida máx.65K tok
Entrada / 1M$0.30
Salida / 1M$2.50
Razonamientominimal · medium · high
Tool use / funcionesVisiónVideoDocumentosBúsqueda web
Chat generalAlto volumen / económicoBaja latencia
Ficha completa — precio en vivo, capacidades, ejemplo →

gemini-3.6-flash

BalanceadoRápido
gemini-3.6-flash

Gemini 3.6 Flash es un modelo multimodal ultrarrápido optimizado para flujos de trabajo con agentes y programación. Ofrece mayor eficiencia en el uso de tokens, una ventana de contexto de un millón de tokens y un rendimiento...

Contexto1M tok
Salida máx.65K tok
Entrada / 1M$1.50
Salida / 1M$7.50
Razonamientomedium · high
Tool use / funcionesVisiónVideoDocumentosBúsqueda web
RazonamientoCódigoAgentic / ToolsDocumentos largos
Ficha completa — precio en vivo, capacidades, ejemplo →

gemini-3.7-flash

BalanceadoRápido
gemini-3.7-flash

Gemini 3.7 Flash es un modelo multimodal avanzado de Google, optimizado para flujos de trabajo de agentes y desarrollo de software. Combina razonamiento de múltiples pasos, alta eficiencia de tokens y capacidades superiores de...

Contexto1M tok
Salida máx.64K tok
Entrada / 1M$0.75
Salida / 1M$3.75
Razonamientomedium · high
Tool use / funcionesVisiónVideoDocumentosBúsqueda web
RazonamientoCódigoAgentic / ToolsDocumentos largosBaja latencia
Ficha completa — precio en vivo, capacidades, ejemplo →

gemini-3.8-flash

BalanceadoRápido
gemini-3.8-flash

Gemini-3.8 flash es un modelo multimodal avanzado de Google, optimizado para flujos de trabajo de agentes y desarrollo de software. Combina razonamiento de múltiples pasos, alta eficiencia de tokens y capacidades superiores de...

Contexto1M tok
Salida máx.64K tok
Entrada / 1M$0.75
Salida / 1M$3.75
Razonamientomedium · high
Tool use / funcionesVisiónVideoDocumentosBúsqueda web
RazonamientoCódigoAgentic / ToolsDocumentos largosBaja latencia
Ficha completa — precio en vivo, capacidades, ejemplo →

Nano Banana 2

Imagen
gemini-3.1-flash-image

Es un modelo multimodal ultrarrápido de Google, optimizado para la generación y comprensión avanzada de imágenes. Combina velocidad superior con alta fidelidad visual, permitiendo a desarrolladores y creadores procesar, editar...

Contexto131K tok
Salida máx.32K tok
Por imagen$0.0670
VisiónGeneración de imagenEdición de imagen (i2i)
Ficha completa — precio en vivo, capacidades, ejemplo →
gemini-3.1-flash-lite-image

Gemini 3.1 Flash Lite Image es un modelo optimizado para velocidad y eficiencia en el procesamiento de contenido visual. Diseñado para tareas ligeras, ofrece respuestas rápidas en el análisis e interpretación de imágenes,...

Contexto50K tok
Por imagen$0.0336
VisiónGeneración de imagenEdición de imagen (i2i)
Ficha completa — precio en vivo, capacidades, ejemplo →
gemini-3-pro-image

Es un modelo avanzado de Google enfocado en la generación y edición profesional de imágenes. Utiliza un motor de razonamiento multimodal para interpretar instrucciones complejas, asegurar consistencia entre múltiples...

Contexto65K tok
Salida máx.32K tok
Por imagen$0.1340
VisiónGeneración de imagenEdición de imagen (i2i)
Ficha completa — precio en vivo, capacidades, ejemplo →

Ejemplo: nivel de thinking

POST
{
  "model": "gemini-3.6-flash",
  "reasoning_effort": "high",
  "messages": [{"role": "user", "content": "Diseñá el schema de una app de reservas"}]
}