TokenGate
Documentación
docs / modelos / minimax
MiniMax

MiniMax M-series

No hay escala de esfuerzo graduada en MiniMax: M3 permite apagar o prender el razonamiento (adaptive/disabled), mientras que los M2.7 lo tienen siempre activo y no se puede desactivar aunque lo pidas explícitamente. image-01 genera y edita imagen.

RazonamientoAdaptive / on
ControlM3: on/off
Visiónsolo M3
Modelos4

Capacidades por generación

Visión — solo en M3

El input multimodal (imagen y video) está limitado al modelo M3. Acepta JPEG, PNG, GIF, WebP (hasta 10 MB) y MP4, AVI, MOV, MKV (hasta 50 MB por URL/base64; videos más grandes requieren la Files API). El parámetro detail (low/default/high) va de unos cientos de tokens hasta ~15K+ tokens por imagen en high.

reasoning_split

En M3, este parámetro separa el pensamiento en reasoning_content y reasoning_details. En los M2.x, el contenido de pensamiento aparece embebido dentro de tags <think> en el propio content — un formato distinto que hay que parsear diferente.

Function calling multi-turno

En conversaciones con tool calls, tenés que reenviar el assistant message completo (incluido el campo tool_calls) en cada turno siguiente para mantener la continuidad de la cadena de razonamiento — omitirlo rompe el contexto.

Sin cache write real

El dialecto OpenAI-compatible de MiniMax no reporta tokens de escritura de caché en la respuesta — algo a tener en cuenta si construís tu propia contabilidad de uso sobre las respuestas crudas de la API.

Modelos

Datos en vivo del catálogo. Tocá el nombre de un modelo para su ficha completa (precio con el toggle COP, capacidades, tramos de contexto, ejemplo).

minimax-image-01

es un modelo de generación de imágenes basado en inteligencia artificial capaz de crear visuales de alta calidad a partir de descripciones textuales. Soporta la edición de imágenes existentes, la síntesis de múltiples...

Contexto350 tok
Salida máx.350 tok
Por imagen$0.0039
VisiónGeneración de imagenEdición de imagen (i2i)
Ficha completa — precio en vivo, capacidades, ejemplo →

MiniMax-M2.7

BalanceadoEstándar
MiniMax-M2.7

MiniMax-M2.7 representa una versión actualizada del modelo de lenguaje de MiniMax. Esta iteración incorpora mejoras en el procesamiento del lenguaje natural, ofreciendo respuestas más coherentes y contextualmente relevantes....

Contexto204K tok
Salida máx.131K tok
Entrada / 1M$0.30
Salida / 1M$1.20
Tool use / funcionesDocumentosBúsqueda web
RazonamientoCódigoChat generalRedacción creativaDocumentos largos
Ficha completa — precio en vivo, capacidades, ejemplo →

MiniMax-M2.7-highspeed

BalanceadoEstándar
MiniMax-M2.7-highspeed

MiniMax-M2.7-highspeed es una versión optimizada para baja latencia que ofrece el mismo rendimiento que el modelo M2.7, pero con una velocidad de generación de ~100 tokens por segundo (frente a los ~60 tps del estándar) ....

Contexto204K tok
Salida máx.131K tok
Entrada / 1M$0.60
Salida / 1M$2.40
Tool use / funcionesDocumentosBúsqueda web
RazonamientoCódigoDocumentos largosBaja latencia
Ficha completa — precio en vivo, capacidades, ejemplo →

MiniMax-M3

FlagshipEstándar
MiniMax-M3

MiniMax-M3 es un modelo de inteligencia artificial desarrollado por la empresa china MiniMax. Se trata de una avanzada arquitectura de lenguaje multilingüe diseñada para ofrecer alto rendimiento en comprensión y generación de...

Contexto1M tok
Salida máx.250K tok
Entrada / 1M$0.30
Salida / 1M$1.20
Razonamientoon
Tool use / funcionesVisiónVideoDocumentosBúsqueda web
RazonamientoCódigoRedacción creativaAgentic / ToolsDocumentos largos
Ficha completa — precio en vivo, capacidades, ejemplo →

Ejemplo: desactivar thinking en M3

POST
{
  "model": "MiniMax-M3",
  "thinking": {"type": "disabled"},
  "messages": [{"role": "user", "content": "Traducí este párrafo al portugués"}]
}

// En M2.7 este mismo body es aceptado pero ignorado — el modelo sigue razonando.