● docs / modelos / glm / glm-5.3
Z (GLM)
Flagship
Estándar
glm-5.3
glm-5.3
GLM-5.3 es un avanzado modelo de lenguaje desarrollado por Zhipu AI. Destaca por su excelente capacidad de razonamiento, comprensión multimodal profunda y una ventana de contexto muy extensa. Está diseñado para resolver tareas complejas, ofreciendo respuestas precisas, coherentes y fluidas en entornos profesionales muy exigentes.
De un vistazo
Modalidades — qué entra, qué sale
Texto
Documentos
Texto
Contexto
1M tokens
Salida máx.
128K tokens
Disponible en
Chat · API
Razonamiento
lowhighmax
Capacidades
Streaming
Respuesta token por token vía SSE con
stream: true.
Tool use / funciones
Llama a funciones que vos definís y encadena sus resultados.
Documentos
Acepta PDFs y documentos largos como entrada.
Búsqueda web
Busca en la web en tiempo real (se cobra aparte).
Precios
Precio del proveedor, sin recargo por token. El único margen de TokenGate es el platform fee del 6% sobre la recarga de saldo. Cómo funciona el billing.
Entrada
$1.40 / 1M tok
Salida
$4.40 / 1M tok
Caché lectura · 20% de la entrada · $0.2800
Un turno típico — 100K tokens de entrada + 20K de salida ≈
$0.2280
Razonamiento
low
default
high
max
Menos esfuerzo → respuesta más rápida y barata. Más esfuerzo → más deliberación y más tokens de salida facturados. Se pasa como reasoning_effort en el body del request. Ver /docs/api.
Ejemplo
Diseñá el modelo de datos (tablas, columnas, índices) para un carrito de compras con reserva temporal de stock que expira a los 15 minutos.
Escribí este prompt en el Chat con
Abrir en el Chat →
glm-5.3 seleccionado para ver la respuesta — varía en cada turno.