kimi-k2.6
kimi-k2.6Kimi K2.6 es el modelo más avanzado de Kimi, con capacidades superiores de escritura de código a largo plazo, mejor cumplimiento de instrucciones y auto-corrección. Arquitectura multimodal nativa (texto, imagen, video), modos...
La familia Kimi está construida alrededor de "razonamiento profundo a través de múltiples llamadas a herramientas para tareas altamente complejas", según su propia doc: primero descompone el problema paso a paso, después actúa con las herramientas disponibles. Los K2.x comparten 256K (262.144) tokens de contexto; K3 llega a 1M y expone niveles de esfuerzo low/high/max.
El razonamiento aparece en el campo reasoning_content de la respuesta, separado del contenido final — igual que DeepSeek.
El parámetro keep controla si el razonamiento previo se retiene entre turnos. Los modelos k2.7-code lo fuerzan siempre en "all"; K2.6 lo deja opcional; K2.5 no lo soporta.
La doc de Moonshot recomienda un mínimo de 16K tokens de salida — un reflejo directo de que estos modelos están pensados para respuestas sustanciales con razonamiento real, no contestaciones cortas.
Moonshot rechaza tool_calls que no tengan su respuesta contigua inmediatamente después — a diferencia de otros proveedores más permisivos con el orden de los mensajes en una conversación con herramientas.
Datos en vivo del catálogo. Tocá el nombre de un modelo para su ficha completa (precio con el toggle COP, capacidades, ejemplo).
kimi-k2.6Kimi K2.6 es el modelo más avanzado de Kimi, con capacidades superiores de escritura de código a largo plazo, mejor cumplimiento de instrucciones y auto-corrección. Arquitectura multimodal nativa (texto, imagen, video), modos...
kimi-k2.7-codeKimi K2.7 Code es el modelo de programación más inteligente de Kimi, con alta tasa de éxito en contextos largos, arquitectura multimodal nativa que soporta texto, imagen, video y modos de razonamiento, además de diálogo y...
kimi-k2.7-code-highspeedKimi K2.7 Code HighSpeed es la versión ultrarrápida del modelo K2.7 Code, con velocidades de hasta 260 tokens/s en contextos cortos y 180 tokens/s en general, ofreciendo una experiencia de codificación extremadamente fluida y...
kimi-k3Kimi K3 es el modelo de lenguaje avanzado de Moonshot AI, diseñado para razonamiento profundo, contexto extenso y precisión en tareas complejas. Destaca en matemáticas, programación, análisis de documentos largos y...
// El tool_result no sigue inmediato al tool_call
messages = [user, assistant(tool_call A), assistant(tool_call B), tool_result(A)]// Cada tool_call va seguido por su tool_result antes de la siguiente
messages = [user, assistant(tool_call A), tool_result(A), assistant(tool_call B), tool_result(B)]