TokenGate
Documentación
docs / modelos / openai / gpt-5.4-mini
OpenAI Rápido / económico Rápido

gpt-5.4-mini

gpt-5.4-mini

GPT-5.4 mini es una versión más pequeña y rápida de GPT-5.4, diseñada para programación, uso de herramientas, razonamiento multimodal y cargas de trabajo en API o subagentes de alto volumen. Busca equilibrar velocidad, capacidad y costo para tareas técnicas exigentes.

De un vistazo

Modalidades — qué entra, qué sale
Texto Imagen Documentos
Texto
Contexto 1M tokens
Salida máx. 128K tokens
Disponible en Chat · API
Razonamiento lowmediumhighxhigh

Capacidades

Streaming Respuesta token por token vía SSE con stream: true.
Tool use / funciones Llama a funciones que vos definís y encadena sus resultados.
Visión Acepta imágenes dentro del prompt.
Documentos Acepta PDFs y documentos largos como entrada.
Búsqueda web Busca en la web en tiempo real (se cobra aparte).

Precios

Precio del proveedor, sin recargo por token. El único margen de TokenGate es el platform fee del 6% sobre la recarga de saldo. Cómo funciona el billing.

Entrada $0.75 / 1M tok
Salida $4.50 / 1M tok
Caché lectura · 10% de la entrada · $0.0750
Un turno típico — 100K tokens de entrada + 20K de salida ≈ $0.1650

Razonamiento

low
medium
high
xhigh

Menos esfuerzo → respuesta más rápida y barata. Más esfuerzo → más deliberación y más tokens de salida facturados. Se pasa como reasoning_effort en el body del request. Ver /docs/api.

Ejemplo

Chat Playground · gpt-5.4-mini
Escribí una función en TypeScript que reintente una promesa con backoff exponencial y jitter (máx. 5 intentos), y sus tests con vitest.
Escribí este prompt en el Chat con gpt-5.4-mini seleccionado para ver la respuesta — varía en cada turno.
Abrir en el Chat →

Fortalezas

CódigoChat general