● docs / modelos / openai / gpt-5.4-mini
OpenAI
Rápido / económico
Rápido
gpt-5.4-mini
gpt-5.4-mini
GPT-5.4 mini es una versión más pequeña y rápida de GPT-5.4, diseñada para programación, uso de herramientas, razonamiento multimodal y cargas de trabajo en API o subagentes de alto volumen. Busca equilibrar velocidad, capacidad y costo para tareas técnicas exigentes.
De un vistazo
Modalidades — qué entra, qué sale
Texto
Imagen
Documentos
Texto
Contexto
1M tokens
Salida máx.
128K tokens
Disponible en
Chat · API
Razonamiento
lowmediumhighxhigh
Capacidades
Streaming
Respuesta token por token vía SSE con
stream: true.
Tool use / funciones
Llama a funciones que vos definís y encadena sus resultados.
Visión
Acepta imágenes dentro del prompt.
Documentos
Acepta PDFs y documentos largos como entrada.
Búsqueda web
Busca en la web en tiempo real (se cobra aparte).
Precios
Precio del proveedor, sin recargo por token. El único margen de TokenGate es el platform fee del 6% sobre la recarga de saldo. Cómo funciona el billing.
Entrada
$0.75 / 1M tok
Salida
$4.50 / 1M tok
Caché lectura · 10% de la entrada · $0.0750
Un turno típico — 100K tokens de entrada + 20K de salida ≈
$0.1650
Razonamiento
low
medium
high
xhigh
Menos esfuerzo → respuesta más rápida y barata. Más esfuerzo → más deliberación y más tokens de salida facturados. Se pasa como reasoning_effort en el body del request. Ver /docs/api.
Ejemplo
Escribí una función en TypeScript que reintente una promesa con backoff exponencial y jitter (máx. 5 intentos), y sus tests con vitest.
Escribí este prompt en el Chat con
Abrir en el Chat →
gpt-5.4-mini seleccionado para ver la respuesta — varía en cada turno.