● docs / modelos / kimi / kimi-k2.6
Kimi (Moonshot)
Flagship
Estándar
kimi-k2.6
kimi-k2.6
Kimi K2.6 es el modelo más avanzado de Kimi, con capacidades superiores de escritura de código a largo plazo, mejor cumplimiento de instrucciones y auto-corrección. Arquitectura multimodal nativa (texto, imagen, video), modos de razonamiento, contexto de 256k, caché automática, ToolCalls, JSON Mode, Partial Mode y búsqueda en internet.
De un vistazo
Modalidades — qué entra, qué sale
Texto
Imagen
Video
Documentos
Texto
Contexto
262K tokens
Salida máx.
49K tokens
Disponible en
Chat · API
Razonamiento
on
Capacidades
Streaming
Respuesta token por token vía SSE con
stream: true.
Tool use / funciones
Llama a funciones que vos definís y encadena sus resultados.
Visión
Acepta imágenes dentro del prompt.
Video
Acepta video como entrada.
Documentos
Acepta PDFs y documentos largos como entrada.
Búsqueda web
Busca en la web en tiempo real (se cobra aparte).
Precios
Precio del proveedor, sin recargo por token. El único margen de TokenGate es el platform fee del 6% sobre la recarga de saldo. Cómo funciona el billing.
Entrada
$0.95 / 1M tok
Salida
$4.00 / 1M tok
Caché lectura · 17% de la entrada · $0.1600
Un turno típico — 100K tokens de entrada + 20K de salida ≈
$0.1750
Razonamiento
Este modelo razona; se activa pasando reasoning_effort: "on" en el body del request. Ver /docs/api.
Ejemplo
Este test de integración falla 1 de cada 10 corridas (código adjunto). Encontrá la condición de carrera y proponé el fix mínimo.
Escribí este prompt en el Chat con
Abrir en el Chat →
kimi-k2.6 seleccionado para ver la respuesta — varía en cada turno.Si usás tool use, cada tool_call necesita su mensaje tool de respuesta en el turno siguiente — Moonshot rechaza el request si falta o no viene contiguo.