TokenGate
Documentación
docs / modelos / glm / GLM-Image
Z (GLM) Imagen

GLM-Image

GLM-Image

GLM-Image es el modelo insignia de Z.AI que utiliza una arquitectura híbrida única. Combina decodificadores autorregresivos y difusión para integrar comprensión global con precisión local. Es ideal para crear pósteres y diagramas complejos, marcando un avance clave en la tecnología generativa cognitiva moderna.

De un vistazo

Modalidades — qué entra, qué sale
Texto
Imagen
Contexto 0K tokens
Disponible en Chat · API

Capacidades

Streaming Respuesta token por token vía SSE con stream: true.
Generación de imagen Produce imágenes a partir de un prompt de texto.

Precios

Precio del proveedor, sin recargo por token. El único margen de TokenGate es el platform fee del 6% sobre la recarga de saldo. Cómo funciona el billing.

Por imagen$0.0150

Benchmark visual

Los tres prompts son los mismos para todos los modelos de imagen del catálogo. Prueban comprensión espacial, relaciones entre objetos, física, sombras, reflejos, geometría y composición — no solo si el modelo hace imágenes bonitas, sino tres dimensiones distintas de inteligencia visual.

  1. Prompt 1 · Biblioteca futuristaRealismo + anatomía + texto legible + materiales + escena compleja
  2. Prompt 2 · Astronauta — 3 panelesConsistencia de personaje + narrativa secuencial + continuidad
  3. Prompt 3 · Cocina cenitalEspacio + física + relaciones entre objetos + reflejos y sombras
Chat Playground · GLM-Image
Prompt 1 Biblioteca futurista

Qué evalúa Realismo + anatomía + texto legible + materiales + escena compleja

Ver el prompt completo
Una escena hiperrealista en una biblioteca futurista de tres pisos durante la hora dorada. En el centro, una mujer ingeniera y un hombre científico conversan frente a una mesa de madera con planos holográficos. Sobre la mesa hay un portátil mostrando un dashboard, un cuaderno, una taza de café con vapor, gafas, un bolígrafo metálico y una pequeña planta.

Al fondo, una ventana panorámica ilumina la escena con luz cálida, sombras naturales y reflejos físicamente correctos sobre un suelo de mármol. Varias personas trabajan en diferentes niveles; algunas caminan por una escalera de cristal.

A través de la ventana se observa una ciudad futurista con jardines verticales, drones, vehículos autónomos, edificios de cristal y nubes volumétricas.

Materiales extremadamente realistas: madera con veta visible, cristal con refracción, metal cepillado, tela, cuero y vegetación detallada. Anatomía humana correcta, cinco dedos por mano, proporciones naturales y expresiones coherentes.

Incluir profundidad de campo sutil, iluminación global, reflejos realistas, sombras suaves, piel detallada, ligera niebla volumétrica y partículas de polvo iluminadas.

En una pantalla debe aparecer exactamente:

"Artificial Intelligence Research Center"

En el portátil:

"Accuracy: 98.7%"
"Latency: 41 ms"
"Models: 128"

Aspecto 4:3, calidad fotográfica profesional, composición equilibrada, alto nivel de detalle, sin deformaciones, texto incorrecto, manos defectuosas, objetos flotantes ni artefactos visuales.
Prompt 2 Astronauta — 3 paneles

Qué evalúa Consistencia de personaje + narrativa secuencial + continuidad

Ver el prompt completo
Crea una secuencia visual narrativa en una sola imagen dividida en tres paneles horizontales, manteniendo exactamente al mismo personaje, ropa, rostro, objetos y estilo entre los tres momentos.

Panel 1: una astronauta de cabello corto, traje blanco con detalles naranjas y una pequeña insignia triangular, descubre una puerta antigua en un planeta desértico.

Panel 2: la astronauta abre la puerta y encuentra un enorme jardín bioluminiscente subterráneo, lleno de árboles azules, agua suspendida y criaturas pequeñas voladoras.

Panel 3: la astronauta camina dentro del jardín mientras observa una estructura alienígena luminosa al fondo.

La transición debe mostrar claramente continuidad temporal y espacial. Mantén constantes los rasgos faciales, proporciones, traje e insignia de la astronauta. Cada panel debe tener perspectiva coherente y una iluminación diferente según el entorno.

Estilo cinematográfico de ciencia ficción, composición profesional, detalles realistas, texturas complejas, profundidad atmosférica, iluminación volumétrica, colores naturales y excelente separación entre planos. Sin personajes duplicados, cambios de identidad, extremidades deformes ni inconsistencias entre paneles.
Prompt 3 Cocina cenital

Qué evalúa Espacio + física + relaciones entre objetos + reflejos y sombras

Ver el prompt completo
Una fotografía hiperrealista de una cocina moderna vista desde arriba, con composición perfectamente organizada.

En el centro hay una tabla de madera rectangular. Sobre ella: un limón entero, un limón cortado por la mitad, un cuchillo de chef colocado horizontalmente, tres tomates, dos hojas de albahaca y una taza blanca.

El limón cortado debe mostrar claramente su interior y estar orientado hacia la cámara. El cuchillo debe proyectar una sombra coherente con la iluminación proveniente de la esquina superior izquierda. La taza debe contener café y proyectar una sombra parcialmente oculta detrás de ella.

A la derecha de la tabla hay un paño azul doblado. A la izquierda, una cuchara metálica cuyo reflejo muestra correctamente parte de la cocina.

Mantén relaciones espaciales precisas entre todos los objetos, proporciones realistas y física consistente. Los objetos deben estar apoyados sobre la superficie, sin superposiciones imposibles.

Fotografía editorial profesional, perspectiva cenital, iluminación natural, materiales físicamente realistas, reflejos precisos, texturas detalladas y profundidad visual. Sin objetos duplicados, deformaciones, sombras contradictorias, elementos flotantes ni geometrías imposibles. Aspecto 4:3.

Escribí cualquiera de estos prompts en el Chat con este modelo seleccionado para reproducir la prueba.

📝

Solo texto→imagen: no edita imágenes de referencia.