TokenGate
Documentación
docs / modelos / kimi
Kimi

Kimi (Moonshot)

La familia Kimi está construida alrededor de "razonamiento profundo a través de múltiples llamadas a herramientas para tareas altamente complejas", según su propia doc: primero descompone el problema paso a paso, después actúa con las herramientas disponibles. Los K2.x comparten 256K (262.144) tokens de contexto; K3 llega a 1M y expone niveles de esfuerzo low/high/max.

RazonamientoEntre tool calls
Controllow/high/max (K3)
Contexto256K–1M
Modelos4

Razonamiento y tool use

reasoning_content

El razonamiento aparece en el campo reasoning_content de la respuesta, separado del contenido final — igual que DeepSeek.

Preserved thinking (keep)

El parámetro keep controla si el razonamiento previo se retiene entre turnos. Los modelos k2.7-code lo fuerzan siempre en "all"; K2.6 lo deja opcional; K2.5 no lo soporta.

max_tokens ≥ 16.000

La doc de Moonshot recomienda un mínimo de 16K tokens de salida — un reflejo directo de que estos modelos están pensados para respuestas sustanciales con razonamiento real, no contestaciones cortas.

Pairing de tools estricto

Moonshot rechaza tool_calls que no tengan su respuesta contigua inmediatamente después — a diferencia de otros proveedores más permisivos con el orden de los mensajes en una conversación con herramientas.

Modelos

Datos en vivo del catálogo. Tocá el nombre de un modelo para su ficha completa (precio con el toggle COP, capacidades, ejemplo).

kimi-k2.6

FlagshipEstándar
kimi-k2.6

Kimi K2.6 es el modelo más avanzado de Kimi, con capacidades superiores de escritura de código a largo plazo, mejor cumplimiento de instrucciones y auto-corrección. Arquitectura multimodal nativa (texto, imagen, video), modos...

Contexto262K tok
Salida máx.49K tok
Entrada / 1M$0.95
Salida / 1M$4.00
Razonamientoon
Tool use / funcionesVisiónVideoDocumentosBúsqueda web
RazonamientoCódigoAgentic / Tools
Ficha completa — precio en vivo, capacidades, ejemplo →

kimi-k2.7-code

FlagshipEstándar
kimi-k2.7-code

Kimi K2.7 Code es el modelo de programación más inteligente de Kimi, con alta tasa de éxito en contextos largos, arquitectura multimodal nativa que soporta texto, imagen, video y modos de razonamiento, además de diálogo y...

Contexto262K tok
Salida máx.49K tok
Entrada / 1M$0.95
Salida / 1M$4.00
Razonamientoon
Tool use / funcionesVisiónVideoDocumentosBúsqueda web
RazonamientoCódigoAgentic / Tools
Ficha completa — precio en vivo, capacidades, ejemplo →

kimi-k2.7-code-highspeed

FlagshipEstándar
kimi-k2.7-code-highspeed

Kimi K2.7 Code HighSpeed es la versión ultrarrápida del modelo K2.7 Code, con velocidades de hasta 260 tokens/s en contextos cortos y 180 tokens/s en general, ofreciendo una experiencia de codificación extremadamente fluida y...

Contexto262K tok
Salida máx.49K tok
Entrada / 1M$1.90
Salida / 1M$8.00
Razonamientoon
Tool use / funcionesVisiónVideoDocumentosBúsqueda web
RazonamientoCódigoAgentic / ToolsBaja latencia
Ficha completa — precio en vivo, capacidades, ejemplo →

kimi-k3

BalanceadoEstándar
kimi-k3

Kimi K3 es el modelo de lenguaje avanzado de Moonshot AI, diseñado para razonamiento profundo, contexto extenso y precisión en tareas complejas. Destaca en matemáticas, programación, análisis de documentos largos y...

Contexto1M tok
Salida máx.128K tok
Entrada / 1M$3.00
Salida / 1M$15.00
Razonamientolow · high · max
Tool use / funcionesVisiónVideoDocumentosBúsqueda web
RazonamientoCódigoMatemáticasAgentic / ToolsDocumentos largosMultilingüe
Ficha completa — precio en vivo, capacidades, ejemplo →

Ejemplo: pairing correcto de tool calls

RECHAZA
// El tool_result no sigue inmediato al tool_call
messages = [user, assistant(tool_call A), assistant(tool_call B), tool_result(A)]
ACEPTA
// Cada tool_call va seguido por su tool_result antes de la siguiente
messages = [user, assistant(tool_call A), tool_result(A), assistant(tool_call B), tool_result(B)]