Grok
xAI describe a su línea de frontera como construida "para código, tareas agénticas y trabajo de conocimiento" — con fuerza particular en debugging de código, workflows basados en agentes, y razonamiento en ciencia, ingeniería y matemática.
Cómo funciona el razonamiento en Grok
Tres niveles (no siempre desactivable)
low para uso agéntico sensible a latencia y tool calling simple, medium para análisis de datos balanceado, high (default) para problemas difíciles. En grok-4.5 el razonamiento no se puede desactivar — no existe nivel none.
Multi-agente: el esfuerzo controla agentes, no profundidad
En grok-4.20-multi-agent, el mismo parámetro de esfuerzo tiene un significado distinto: low/medium usan 4 agentes coordinados, high y xhigh escalan la cantidad de agentes colaborando en paralelo sobre el mismo problema.
Parámetros incompatibles
presence_penalty, frequency_penalty y stop no se pueden usar junto con razonamiento activo en los modelos que lo soportan.
prompt_cache_key
xAI recomienda fuertemente setear este parámetro para rutear conversaciones repetidas al mismo servidor — así garantizás cache hits reales en vez de que cada request caiga en un servidor "frío" sin caché acumulado.
Grok 4.5
grok-4.5
flagship · rápidoEl más nuevo y, según xAI, "el más inteligente y rápido" — sucesor de 4.3 para código, chat y tareas agénticas. Tiene un tramo separado por tamaño de prompt: pasar los 200K tokens de prompt encarece todo el request, no solo el excedente. Function calling, web search, X search y ejecución de código incluidos. Primer modelo Grok con tarifa de cached input diferenciada. Cutoff de conocimiento: febrero 2026. No disponible aún en el API console para usuarios de la UE al momento de escribir esto.
Grok 4.3
grok-4.3
flagship · estándarContexto de 1M — es el único de la familia Grok con opción none real, la única forma de apagar el razonamiento del todo en esta línea.
Grok 4.20 Multi-Agent
grok-4.20-multi-agent
flagship · lentoEl único modelo del catálogo donde el "nivel de esfuerzo" no controla profundidad de pensamiento sino cuántos agentes trabajan en paralelo sobre el mismo problema.
Grok Build 0.1
grok-build-0.1
balanced · estándarSin razonamiento graduado — pensado como modelo de código directo, sin la fase explícita de "pensar antes de responder".
Ejemplo: nivel de esfuerzo en Grok 4.3
{
"model": "grok-4.3",
"reasoning_effort": "none",
"messages": [{"role": "user", "content": "Formateá este JSON con indentación de 2 espacios"}]
}