TokenGate
Documentación
docs / modelos / glm
Z

GLM (ZhipuAI)

La familia GLM está construida alrededor de "Deep Thinking": un mecanismo de cadena de pensamiento que descompone problemas complejos en pasos de análisis gradual. Viene activado por defecto en la línea GLM-5 y se puede desactivar por configuración cuando no lo necesitás. CogView-4 y GLM-Image generan imagen.

RazonamientoInterleaved
Controlpor turno
Defaultactivado (GLM-5)
Modelos6

Cómo funciona el razonamiento en GLM

Thinking entrelazado (interleaved)

GLM puede razonar entre llamadas a herramienta y después de recibir sus resultados, no solo antes de la primera respuesta. Los bloques de pensamiento deben preservarse explícitamente y devolverse junto con los resultados de la tool call para mantener la coherencia del razonamiento.

Preserved thinking

Retiene el razonamiento de turnos previos para mejorar continuidad de contexto y eficiencia de caché. Viene activado por default en el endpoint "Coding Plan" de Z, pero desactivado por default en el endpoint estándar de API que usa TokenGate.

Control por turno

Podés desactivar el pensamiento para una consulta rápida y volver a activarlo para la siguiente pregunta compleja, dentro de la misma conversación — no es una decisión de todo-o-nada por sesión.

Esfuerzo graduado (5.2+)

El parámetro reasoning_effort escala de minimal a max; solo aplica cuando thinking.type="enabled". GLM-5.3 expone low/high/max. Z mapea internamente: low/medium→high, xhigh→max — el control es más grueso de lo que sugiere la escala nominal.

Según la propia doc de Z, Deep Thinking conviene para arquitectura técnica, investigación académica, análisis de datos, estrategia de negocio y creatividad estructurada — y conviene desactivarlo para lookups factuales, traducción y clasificación simple, donde solo agrega latencia y consumo de tokens sin sumar calidad.

Modelos

Datos en vivo del catálogo. Tocá el nombre de un modelo para su ficha completa (precio con el toggle COP, capacidades, ejemplo).

CogView-4

Imagen
CogView-4

CogView-4 es el primer modelo de código abierto de Z.AI para texto a imagen. Destaca por su superior comprensión semántica y calidad visual, permitiendo generar texto bilingüe (inglés/chino) de cualquier longitud y crear...

Contexto1 tok
Por imagen$0.0100
Generación de imagen
Ficha completa — precio en vivo, capacidades, ejemplo →

glm-5

FlagshipEstándarSolo Chat
glm-5

GLM-5.2 es un avanzado modelo de lenguaje desarrollado por Zhipu AI. Destaca por su excelente capacidad de razonamiento, comprensión multimodal profunda y una ventana de contexto muy extensa. Está diseñado para resolver tareas...

Contexto200K tok
Salida máx.128K tok
Entrada / 1M$1.00
Salida / 1M$3.20
Razonamientolow · medium · high · xhigh
Tool use / funcionesDocumentosBúsqueda web
RazonamientoCódigoAgentic / Tools
Ficha completa — precio en vivo, capacidades, ejemplo →

glm-5.2

FlagshipEstándar
glm-5.2

GLM-5.2 es un avanzado modelo de lenguaje desarrollado por Zhipu AI. Destaca por su excelente capacidad de razonamiento, comprensión multimodal profunda y una ventana de contexto muy extensa. Está diseñado para resolver tareas...

Contexto1M tok
Salida máx.128K tok
Entrada / 1M$1.40
Salida / 1M$4.40
Razonamientominimal · low · medium · high · xhigh · max
Tool use / funcionesDocumentosBúsqueda web
RazonamientoCódigoAgentic / ToolsDocumentos largos
Ficha completa — precio en vivo, capacidades, ejemplo →

glm-5.3

FlagshipEstándar
glm-5.3

GLM-5.3 es un avanzado modelo de lenguaje desarrollado por Zhipu AI. Destaca por su excelente capacidad de razonamiento, comprensión multimodal profunda y una ventana de contexto muy extensa. Está diseñado para resolver tareas...

Contexto1M tok
Salida máx.128K tok
Entrada / 1M$1.40
Salida / 1M$4.40
Razonamientolow · high · max
Tool use / funcionesDocumentosBúsqueda web
RazonamientoCódigoAgentic / ToolsDocumentos largos
Ficha completa — precio en vivo, capacidades, ejemplo →

glm-5.3-flash

FlagshipEstándar
glm-5.3-flash

GLM-5.3-flash es un avanzado modelo de lenguaje desarrollado por Zhipu AI. Destaca por su excelente capacidad de razonamiento, comprensión multimodal profunda y una ventana de contexto muy extensa. Está diseñado para resolver...

Contexto1M tok
Salida máx.128K tok
Entrada / 1M$0.15
Salida / 1M$0.50
Razonamientolow · high · max
Tool use / funcionesDocumentosBúsqueda web
RazonamientoCódigoAgentic / ToolsDocumentos largos
Ficha completa — precio en vivo, capacidades, ejemplo →

GLM-Image

Imagen
GLM-Image

GLM-Image es el modelo insignia de Z.AI que utiliza una arquitectura híbrida única. Combina decodificadores autorregresivos y difusión para integrar comprensión global con precisión local. Es ideal para crear pósteres y...

Contexto1 tok
Por imagen$0.0150
Generación de imagen
Ficha completa — precio en vivo, capacidades, ejemplo →

Ejemplo: desactivar thinking para un lookup simple

POST
{
  "model": "glm-5.3",
  "thinking": {"type": "disabled"},
  "messages": [{"role": "user", "content": "¿Cuál es la capital de Perú?"}]
}