gpt-5.6-luna
gpt-5.6-luna
GPT-5.6 Luna es el modelo más rápido y económico de la familia GPT-5.6, optimizado para cargas masivas, automatización, clasificación, resúmenes, chat y aplicaciones en tiempo real. Ofrece excelente relación rendimiento-costo, baja latencia, amplio contexto y soporte para razonamiento, ideal para producción escalable
De un vistazo
Capacidades
stream: true.
Precios
Precio del proveedor, sin recargo por token. El único margen de TokenGate es el platform fee del 6% sobre la recarga de saldo. Cómo funciona el billing.
Precio por tamaño del prompt
El proveedor cobra por tramo según el tamaño del prompt de entrada. El tramo lo fija ese tamaño y rige todo el request, no solo el excedente.
Precios por millón de tokens. Cada tramo arranca en su umbral, inclusive.
Razonamiento
Menos esfuerzo → respuesta más rápida y barata. Más esfuerzo → más deliberación y más tokens de salida facturados. Se pasa como reasoning_effort en el body del request. Ver /docs/api.
Ejemplo
gpt-5.6-luna seleccionado para ver la respuesta — varía en cada turno.