TokenGate
Documentación
docs / modelos / google / gemini-2.5-flash-lite
Google (Gemini) Rápido / económico Rápido

gemini-2.5-flash-lite

gemini-2.5-flash-lite

Gemini 2.5 Flash Lite es un modelo ultraligero diseñado para máxima velocidad y eficiencia. Ideal para tareas sencillas, respuestas instantáneas y entornos de alta demanda, ofrece un rendimiento ágil y económico, optimizando al máximo tus recursos sin comprometer la precisión necesaria en interacciones críticas.

De un vistazo

Modalidades — qué entra, qué sale
Texto Imagen Video Documentos
Texto
Contexto 1M tokens
Salida máx. 64K tokens
Disponible en Chat · API
Razonamiento lowmediumhigh

Capacidades

Streaming Respuesta token por token vía SSE con stream: true.
Tool use / funciones Llama a funciones que vos definís y encadena sus resultados.
Visión Acepta imágenes dentro del prompt.
Video Acepta video como entrada.
Documentos Acepta PDFs y documentos largos como entrada.
Búsqueda web Busca en la web en tiempo real (se cobra aparte).

Precios

Precio del proveedor, sin recargo por token. El único margen de TokenGate es el platform fee del 6% sobre la recarga de saldo. Cómo funciona el billing.

Entrada $0.10 / 1M tok
Salida $0.40 / 1M tok
Caché lectura · 15% de la entrada · $0.0150
Un turno típico — 100K tokens de entrada + 20K de salida ≈ $0.0180

Razonamiento

low default
medium
high

Menos esfuerzo → respuesta más rápida y barata. Más esfuerzo → más deliberación y más tokens de salida facturados. Se pasa como reasoning_effort en el body del request. Ver /docs/api.

Ejemplo

Chat Playground · gemini-2.5-flash-lite
Traducí estas frases de producto al inglés manteniendo el tono de marketing (directo, sin superlativos vacíos): 1. "Una sola API key para todos los modelos." 2. "Pagás el costo del proveedor, sin recargo por token."
Escribí este prompt en el Chat con gemini-2.5-flash-lite seleccionado para ver la respuesta — varía en cada turno.
Abrir en el Chat →

Fortalezas

Chat generalAlto volumen / económicoBaja latencia