TokenGate
Documentación
docs / modelos / openai
OpenAI

GPT-5.x

Los modelos de texto de la familia 5.x son modelos de razonamiento: usan tokens internos de "pensamiento" antes de producir la respuesta, lo que les permite "planear, usar herramientas con efectividad, inspeccionar alternativas, recuperarse de la ambigüedad y resolver tareas de varios pasos", según la propia doc de OpenAI. Rinden particularmente bien en código, razonamiento científico, debugging y workflows agénticos. gpt-image-2 es aparte — generación y edición de imagen.

RazonamientoGraduado
Controllow → max
Tool callingparalelo
Modelos7

Capacidades transversales

Esfuerzo graduado

low para tareas sensibles a latencia con uso de herramientas. medium (default) equilibra calidad y performance. high/xhigh reservado para debugging complejo y planeación profunda. La familia 5.6 (luna/sol/terra) suma un escalón max.

Function calling en paralelo

Varias funciones en un mismo turno por default; desactivable con parallel_tool_calls: false para forzar como máximo una llamada. Ojo: si el modelo llama a varias funciones en el mismo turno, el modo strict se desactiva para esas llamadas puntuales.

Modo strict

Con strict: true el schema se cumple de forma garantizada (structured outputs) en vez de "mejor esfuerzo" — requiere additionalProperties: false y todos los campos marcados required (los opcionales se modelan como type: ["string","null"]).

Tool search

Carga herramientas poco usadas bajo demanda en vez de mandarlas todas en cada request — reduce el overhead de tokens cuando tenés catálogos grandes de herramientas.

⚠️

Los modelos GPT-5.x están documentados por OpenAI sobre la Responses API (reasoning:{effort:...}). El adapter de TokenGate manda reasoning_effort plano por /v1/chat/completions — es la convención válida para razonamiento en ese endpoint, pero conviene probarlo contra un modelo real antes de asumir paridad total de features con la Responses API.

Modelos

Datos en vivo del catálogo. Tocá el nombre de un modelo para su ficha completa (precio con el toggle COP, capacidades, franjas, ejemplo).

gpt-5.4-mini

Rápido / económicoRápido
gpt-5.4-mini

GPT-5.4 mini es una versión más pequeña y rápida de GPT-5.4, diseñada para programación, uso de herramientas, razonamiento multimodal y cargas de trabajo en API o subagentes de alto volumen. Busca equilibrar velocidad,...

Contexto1M tok
Salida máx.128K tok
Entrada / 1M$0.75
Salida / 1M$4.50
Razonamientolow · medium · high · xhigh
Tool use / funcionesVisiónDocumentosBúsqueda web
CódigoChat general
Ficha completa — precio en vivo, capacidades, ejemplo →

gpt-5.4-nano

Rápido / económicoRápido
gpt-5.4-nano

GPT-5.4 nano es el modelo más ligero y barato de la familia GPT-5.4, optimizado para tareas de alto volumen y baja latencia como clasificación, extracción de datos y subagentes. Soporta texto e imágenes, con contexto muy...

Contexto1M tok
Salida máx.128K tok
Entrada / 1M$0.20
Salida / 1M$1.25
Razonamientolow · medium · high · xhigh
Tool use / funcionesVisiónDocumentosBúsqueda web
Chat generalAlto volumen / económicoBaja latencia
Ficha completa — precio en vivo, capacidades, ejemplo →

gpt-5.6-luna

Rápido / económicoRápido
gpt-5.6-luna

GPT-5.6 Luna es el modelo más rápido y económico de la familia GPT-5.6, optimizado para cargas masivas, automatización, clasificación, resúmenes, chat y aplicaciones en tiempo real. Ofrece excelente relación rendimiento-costo,...

Contexto1M tok
Salida máx.128K tok
Entrada / 1M$0.20
Salida / 1M$1.20
Razonamientolow · medium · high · xhigh · max
Tool use / funcionesVisiónDocumentosBúsqueda web
Chat generalAlto volumen / económico
Ficha completa — precio en vivo, capacidades, ejemplo →

gpt-5.6-sol

FlagshipEstándar
gpt-5.6-sol

GPT-5.6 Sol es el modelo insignia de OpenAI, diseñado para tareas complejas que requieren razonamiento avanzado. Destaca en programación, investigación, ciencia, ciberseguridad y trabajo profesional, ofreciendo inteligencia de...

Contexto1M tok
Salida máx.128K tok
Entrada / 1M$4.00
Salida / 1M$20.00
Razonamientolow · medium · high · xhigh · max
Tool use / funcionesVisiónDocumentosBúsqueda web
RazonamientoCódigoMatemáticasAgentic / ToolsDocumentos largos
Ficha completa — precio en vivo, capacidades, ejemplo →

gpt-5.6-terra

FlagshipEstándar
gpt-5.6-terra

GPT-5.6 Terra es el modelo equilibrado de OpenAI para trabajo cotidiano, combinando inteligencia, velocidad y costo. Ofrece rendimiento competitivo frente a GPT-5.5, capacidades para programación, análisis y agentes, además de...

Contexto1M tok
Salida máx.128K tok
Entrada / 1M$2.00
Salida / 1M$12.00
Razonamientolow · medium · high · xhigh · max
Tool use / funcionesVisiónDocumentosBúsqueda web
RazonamientoCódigoAgentic / Tools
Ficha completa — precio en vivo, capacidades, ejemplo →

gpt-image-2

Imagen
gpt-image-2-2026-04-21

GPT-Image-2 es el modelo de generación visual más avanzado de OpenAI, diseñado para crear y editar imágenes con alta calidad, precisión y velocidad. Destaca por seguir instrucciones complejas, representar texto con mayor...

Contexto1 tok
Por imagen$0.0050
VisiónGeneración de imagenEdición de imagen (i2i)
Ficha completa — precio en vivo, capacidades, ejemplo →

Ejemplo: esfuerzo de razonamiento

POST
{
  "model": "gpt-5.6-sol",
  "reasoning_effort": "high",
  "messages": [{"role": "user", "content": "Optimizá esta query SQL de 40 líneas"}]
}