TokenGate
Documentación
docs / modelos / glm / glm-5
Z (GLM) Flagship Estándar

glm-5

glm-5

GLM-5.2 es un avanzado modelo de lenguaje desarrollado por Zhipu AI. Destaca por su excelente capacidad de razonamiento, comprensión multimodal profunda y una ventana de contexto muy extensa. Está diseñado para resolver tareas complejas, ofreciendo respuestas precisas, coherentes y fluidas en entornos profesionales muy exigentes.

De un vistazo

Modalidades — qué entra, qué sale
Texto Documentos
Texto
Contexto 200K tokens
Salida máx. 128K tokens
Disponible en Chat
Razonamiento lowmediumhighxhigh

Capacidades

Streaming Respuesta token por token vía SSE con stream: true.
Tool use / funciones Llama a funciones que vos definís y encadena sus resultados.
Documentos Acepta PDFs y documentos largos como entrada.
Búsqueda web Busca en la web en tiempo real (se cobra aparte).

Precios

Precio del proveedor, sin recargo por token. El único margen de TokenGate es el platform fee del 6% sobre la recarga de saldo. Cómo funciona el billing.

Entrada $1.00 / 1M tok
Salida $3.20 / 1M tok
Caché lectura · 22% de la entrada · $0.2200
Un turno típico — 100K tokens de entrada + 20K de salida ≈ $0.1640

Razonamiento

low
medium default
high
xhigh

Menos esfuerzo → respuesta más rápida y barata. Más esfuerzo → más deliberación y más tokens de salida facturados. Se pasa como reasoning_effort en el body del request. Ver /docs/api.

Ejemplo

Chat Playground · glm-5
Resolvé paso a paso: una recarga de saldo de USD 50 tiene un platform fee del 6 % que se retiene al acreditar. ¿Cuánto saldo neto se acredita y cuánto retiene la plataforma?
Escribí este prompt en el Chat con glm-5 seleccionado para ver la respuesta — varía en cada turno.
Abrir en el Chat →

Fortalezas

RazonamientoCódigoAgentic / Tools