TokenGate
Documentación
docs / modelos / kimi / kimi-k2.7-code-highspeed
Kimi (Moonshot) Flagship Estándar

kimi-k2.7-code-highspeed

kimi-k2.7-code-highspeed

Kimi K2.7 Code HighSpeed es la versión ultrarrápida del modelo K2.7 Code, con velocidades de hasta 260 tokens/s en contextos cortos y 180 tokens/s en general, ofreciendo una experiencia de codificación extremadamente fluida y eficiente.

De un vistazo

Modalidades — qué entra, qué sale
Texto Imagen Video Documentos
Texto
Contexto 262K tokens
Salida máx. 49K tokens
Disponible en Chat · API
Razonamiento on

Capacidades

Streaming Respuesta token por token vía SSE con stream: true.
Tool use / funciones Llama a funciones que vos definís y encadena sus resultados.
Visión Acepta imágenes dentro del prompt.
Video Acepta video como entrada.
Documentos Acepta PDFs y documentos largos como entrada.
Búsqueda web Busca en la web en tiempo real (se cobra aparte).

Precios

Precio del proveedor, sin recargo por token. El único margen de TokenGate es el platform fee del 6% sobre la recarga de saldo. Cómo funciona el billing.

Entrada $1.90 / 1M tok
Salida $8.00 / 1M tok
Caché lectura · 20% de la entrada · $0.3800
Un turno típico — 100K tokens de entrada + 20K de salida ≈ $0.3500

Razonamiento

Este modelo razona; se activa pasando reasoning_effort: "on" en el body del request. Ver /docs/api.

Ejemplo

Chat Playground · kimi-k2.7-code-highspeed
Convertí este componente de React de class component a función con hooks, manteniendo el comportamiento. [pegá el componente]
Escribí este prompt en el Chat con kimi-k2.7-code-highspeed seleccionado para ver la respuesta — varía en cada turno.
Abrir en el Chat →
📝

Si usás tool use, cada tool_call necesita su mensaje tool de respuesta en el turno siguiente — Moonshot rechaza el request si falta o no viene contiguo.

Fortalezas

RazonamientoCódigoAgentic / ToolsBaja latencia