No hay escala de esfuerzo graduada en MiniMax: M3 permite apagar o prender el razonamiento (adaptive/disabled), mientras que los M2.7 lo tienen siempre activo y no se puede desactivar aunque lo pidas explícitamente. image-01 genera y edita imagen.
El input multimodal (imagen y video) está limitado al modelo M3. Acepta JPEG, PNG, GIF, WebP (hasta 10 MB) y MP4, AVI, MOV, MKV (hasta 50 MB por URL/base64; videos más grandes requieren la Files API). El parámetro detail (low/default/high) va de unos cientos de tokens hasta ~15K+ tokens por imagen en high.
reasoning_split
En M3, este parámetro separa el pensamiento en reasoning_content y reasoning_details. En los M2.x, el contenido de pensamiento aparece embebido dentro de tags <think> en el propio content — un formato distinto que hay que parsear diferente.
Function calling multi-turno
En conversaciones con tool calls, tenés que reenviar el assistant message completo (incluido el campo tool_calls) en cada turno siguiente para mantener la continuidad de la cadena de razonamiento — omitirlo rompe el contexto.
Sin cache write real
El dialecto OpenAI-compatible de MiniMax no reporta tokens de escritura de caché en la respuesta — algo a tener en cuenta si construís tu propia contabilidad de uso sobre las respuestas crudas de la API.
Modelos
Datos en vivo del catálogo. Tocá el nombre de un modelo para su ficha completa (precio con el toggle COP, capacidades, tramos de contexto, ejemplo).
es un modelo de generación de imágenes basado en inteligencia artificial capaz de crear visuales de alta calidad a partir de descripciones textuales. Soporta la edición de imágenes existentes, la síntesis de múltiples...
MiniMax-M2.7 representa una versión actualizada del modelo de lenguaje de MiniMax. Esta iteración incorpora mejoras en el procesamiento del lenguaje natural, ofreciendo respuestas más coherentes y contextualmente relevantes....
MiniMax-M2.7-highspeed es una versión optimizada para baja latencia que ofrece el mismo rendimiento que el modelo M2.7, pero con una velocidad de generación de ~100 tokens por segundo (frente a los ~60 tps del estándar) ....
MiniMax-M3 es un modelo de inteligencia artificial desarrollado por la empresa china MiniMax. Se trata de una avanzada arquitectura de lenguaje multilingüe diseñada para ofrecer alto rendimiento en comprensión y generación de...
Contexto1M tok
Salida máx.250K tok
Entrada / 1M$0.30
Salida / 1M$1.20
Razonamientoon
Tool use / funcionesVisiónVideoDocumentosBúsqueda web
{
"model": "MiniMax-M3",
"thinking": {"type": "disabled"},
"messages": [{"role": "user", "content": "Traducí este párrafo al portugués"}]
}
// En M2.7 este mismo body es aceptado pero ignorado — el modelo sigue razonando.