● docs / modelos / google / gemini-3.6-flash
Google (Gemini)
Balanceado
Rápido
gemini-3.6-flash
gemini-3.6-flash
Gemini 3.6 Flash es un modelo multimodal ultrarrápido optimizado para flujos de trabajo con agentes y programación. Ofrece mayor eficiencia en el uso de tokens, una ventana de contexto de un millón de tokens y un rendimiento superior en tareas complejas a menor costo.
De un vistazo
Modalidades — qué entra, qué sale
Texto
Imagen
Video
Documentos
Texto
Contexto
1M tokens
Salida máx.
65K tokens
Disponible en
Chat · API
Razonamiento
mediumhigh
Capacidades
Streaming
Respuesta token por token vía SSE con
stream: true.
Tool use / funciones
Llama a funciones que vos definís y encadena sus resultados.
Visión
Acepta imágenes dentro del prompt.
Video
Acepta video como entrada.
Documentos
Acepta PDFs y documentos largos como entrada.
Búsqueda web
Busca en la web en tiempo real (se cobra aparte).
Precios
Precio del proveedor, sin recargo por token. El único margen de TokenGate es el platform fee del 6% sobre la recarga de saldo. Cómo funciona el billing.
Entrada
$1.50 / 1M tok
Salida
$7.50 / 1M tok
Caché lectura · 10% de la entrada · $0.1500
Un turno típico — 100K tokens de entrada + 20K de salida ≈
$0.3000
Razonamiento
medium
default
high
Menos esfuerzo → respuesta más rápida y barata. Más esfuerzo → más deliberación y más tokens de salida facturados. Se pasa como reasoning_effort en el body del request. Ver /docs/api.
Ejemplo
Adjunto un PDF de términos de servicio de 40 páginas. Armá un índice con la página y el título de cada sección donde se hable de límites de uso o cuotas.
Escribí este prompt en el Chat con
Abrir en el Chat →
gemini-3.6-flash seleccionado para ver la respuesta — varía en cada turno.