● docs / modelos / minimax / MiniMax-M2.7-highspeed
MiniMax
Balanceado
Estándar
MiniMax-M2.7-highspeed
MiniMax-M2.7-highspeed
MiniMax-M2.7-highspeed es una versión optimizada para baja latencia que ofrece el mismo rendimiento que el modelo M2.7, pero con una velocidad de generación de ~100 tokens por segundo (frente a los ~60 tps del estándar) . Sobresale en tareas de ingeniería, codificación y flujos de trabajo de agentes
De un vistazo
Modalidades — qué entra, qué sale
Texto
Documentos
Texto
Contexto
204K tokens
Salida máx.
131K tokens
Disponible en
Chat · API
Capacidades
Streaming
Respuesta token por token vía SSE con
stream: true.
Tool use / funciones
Llama a funciones que vos definís y encadena sus resultados.
Documentos
Acepta PDFs y documentos largos como entrada.
Búsqueda web
Busca en la web en tiempo real (se cobra aparte).
Precios
Precio del proveedor, sin recargo por token. El único margen de TokenGate es el platform fee del 6% sobre la recarga de saldo. Cómo funciona el billing.
Entrada
$0.60 / 1M tok
Salida
$2.40 / 1M tok
Caché lectura · 15% de la entrada · $0.0900
Un turno típico — 100K tokens de entrada + 20K de salida ≈
$0.1080
Ejemplo
Dame 10 títulos alternativos para este artículo, ordenados de más sobrio a más llamativo. [pegá el título y el primer párrafo]
Escribí este prompt en el Chat con
Abrir en el Chat →
MiniMax-M2.7-highspeed seleccionado para ver la respuesta — varía en cada turno.