TokenGate
Documentación
docs / modelos / grok
xAI

Grok

xAI describe a su línea de frontera como construida "para código, tareas agénticas y trabajo de conocimiento" — con fuerza particular en debugging de código, workflows basados en agentes, y razonamiento en ciencia, ingeniería y matemática.

Cómo funciona el razonamiento en Grok

🎚️

Tres niveles (no siempre desactivable)

low para uso agéntico sensible a latencia y tool calling simple, medium para análisis de datos balanceado, high (default) para problemas difíciles. En grok-4.5 el razonamiento no se puede desactivar — no existe nivel none.

🤖

Multi-agente: el esfuerzo controla agentes, no profundidad

En grok-4.20-multi-agent, el mismo parámetro de esfuerzo tiene un significado distinto: low/medium usan 4 agentes coordinados, high y xhigh escalan la cantidad de agentes colaborando en paralelo sobre el mismo problema.

🚫

Parámetros incompatibles

presence_penalty, frequency_penalty y stop no se pueden usar junto con razonamiento activo en los modelos que lo soportan.

🔑

prompt_cache_key

xAI recomienda fuertemente setear este parámetro para rutear conversaciones repetidas al mismo servidor — así garantizás cache hits reales en vez de que cada request caiga en un servidor "frío" sin caché acumulado.

Grok 4.5

grok-4.5

flagship · rápido
Contexto500K tok
Esfuerzolow–high, sin off

El más nuevo y, según xAI, "el más inteligente y rápido" — sucesor de 4.3 para código, chat y tareas agénticas. Tiene un tramo separado por tamaño de prompt: pasar los 200K tokens de prompt encarece todo el request, no solo el excedente. Function calling, web search, X search y ejecución de código incluidos. Primer modelo Grok con tarifa de cached input diferenciada. Cutoff de conocimiento: febrero 2026. No disponible aún en el API console para usuarios de la UE al momento de escribir esto.

Cuándo usarlo: debugging de código y agentes de herramienta donde también valorás velocidad de respuesta.
razonamientocódigoagentic_tools

Grok 4.3

grok-4.3

flagship · estándar
Contexto1M tok
Salida máx.~131K tok
Esfuerzonone/low/medium/high

Contexto de 1M — es el único de la familia Grok con opción none real, la única forma de apagar el razonamiento del todo en esta línea.

Cuándo usarlo: misma franja que 4.5 pero con más control fino sobre cuánto razona (incluida la opción de apagarlo del todo).
razonamientocódigoagentic_tools

Grok 4.20 Multi-Agent

grok-4.20-multi-agent

flagship · lento
Contexto1M tok
EsfuerzoNº de agentes

El único modelo del catálogo donde el "nivel de esfuerzo" no controla profundidad de pensamiento sino cuántos agentes trabajan en paralelo sobre el mismo problema.

Cuándo usarlo: tareas donde de verdad se beneficiarían de varios agentes coordinados trabajando el mismo problema — no lo uses como reemplazo directo de 4.3/4.5 para tareas simples, la coordinación extra no se justifica ahí.
razonamientocódigoagentic_tools

Grok Build 0.1

grok-build-0.1

balanced · estándar
Contexto256K tok
Esfuerzono soporta

Sin razonamiento graduado — pensado como modelo de código directo, sin la fase explícita de "pensar antes de responder".

Cuándo usarlo: código y agentic tools rápidos, donde no necesitás la latencia extra del razonamiento.
códigoagentic_tools

Ejemplo: nivel de esfuerzo en Grok 4.3

{
  "model": "grok-4.3",
  "reasoning_effort": "none",
  "messages": [{"role": "user", "content": "Formateá este JSON con indentación de 2 espacios"}]
}