gpt-5.4-mini
gpt-5.4-miniGPT-5.4 mini es una versión más pequeña y rápida de GPT-5.4, diseñada para programación, uso de herramientas, razonamiento multimodal y cargas de trabajo en API o subagentes de alto volumen. Busca equilibrar velocidad,...
Los modelos de texto de la familia 5.x son modelos de razonamiento: usan tokens internos de "pensamiento" antes de producir la respuesta, lo que les permite "planear, usar herramientas con efectividad, inspeccionar alternativas, recuperarse de la ambigüedad y resolver tareas de varios pasos", según la propia doc de OpenAI. Rinden particularmente bien en código, razonamiento científico, debugging y workflows agénticos. gpt-image-2 es aparte — generación y edición de imagen.
low para tareas sensibles a latencia con uso de herramientas. medium (default) equilibra calidad y performance. high/xhigh reservado para debugging complejo y planeación profunda. La familia 5.6 (luna/sol/terra) suma un escalón max.
Varias funciones en un mismo turno por default; desactivable con parallel_tool_calls: false para forzar como máximo una llamada. Ojo: si el modelo llama a varias funciones en el mismo turno, el modo strict se desactiva para esas llamadas puntuales.
Con strict: true el schema se cumple de forma garantizada (structured outputs) en vez de "mejor esfuerzo" — requiere additionalProperties: false y todos los campos marcados required (los opcionales se modelan como type: ["string","null"]).
Carga herramientas poco usadas bajo demanda en vez de mandarlas todas en cada request — reduce el overhead de tokens cuando tenés catálogos grandes de herramientas.
Los modelos GPT-5.x están documentados por OpenAI sobre la Responses API (reasoning:{effort:...}). El adapter de TokenGate manda reasoning_effort plano por /v1/chat/completions — es la convención válida para razonamiento en ese endpoint, pero conviene probarlo contra un modelo real antes de asumir paridad total de features con la Responses API.
Datos en vivo del catálogo. Tocá el nombre de un modelo para su ficha completa (precio con el toggle COP, capacidades, franjas, ejemplo).
gpt-5.4-miniGPT-5.4 mini es una versión más pequeña y rápida de GPT-5.4, diseñada para programación, uso de herramientas, razonamiento multimodal y cargas de trabajo en API o subagentes de alto volumen. Busca equilibrar velocidad,...
gpt-5.4-nanoGPT-5.4 nano es el modelo más ligero y barato de la familia GPT-5.4, optimizado para tareas de alto volumen y baja latencia como clasificación, extracción de datos y subagentes. Soporta texto e imágenes, con contexto muy...
gpt-5.6-lunaGPT-5.6 Luna es el modelo más rápido y económico de la familia GPT-5.6, optimizado para cargas masivas, automatización, clasificación, resúmenes, chat y aplicaciones en tiempo real. Ofrece excelente relación rendimiento-costo,...
gpt-5.6-solGPT-5.6 Sol es el modelo insignia de OpenAI, diseñado para tareas complejas que requieren razonamiento avanzado. Destaca en programación, investigación, ciencia, ciberseguridad y trabajo profesional, ofreciendo inteligencia de...
gpt-5.6-terraGPT-5.6 Terra es el modelo equilibrado de OpenAI para trabajo cotidiano, combinando inteligencia, velocidad y costo. Ofrece rendimiento competitivo frente a GPT-5.5, capacidades para programación, análisis y agentes, además de...
gpt-6-astraGPT 6 Astra
gpt-image-2-2026-04-21GPT-Image-2 es el modelo de generación visual más avanzado de OpenAI, diseñado para crear y editar imágenes con alta calidad, precisión y velocidad. Destaca por seguir instrucciones complejas, representar texto con mayor...
{
"model": "gpt-5.6-sol",
"reasoning_effort": "high",
"messages": [{"role": "user", "content": "Optimizá esta query SQL de 40 líneas"}]
}