TokenGate
Documentación
docs / modelos

Modelos

TokenGate da acceso a ocho proveedores bajo el mismo slug y la misma factura. Cada proveedor tiene su propia página con specs completas, mecánica de razonamiento, capacidades de tool use/visión y ejemplos de código — contrastado contra la documentación oficial de cada uno. Para el catálogo activo hoy, andá a /models.

🧭

Regla rápida: si no sabés por dónde arrancar, usá un modelo balanced para la mayoría de las tareas, subí a un flagship cuando el problema sea genuinamente difícil (arquitectura, debugging profundo, matemática), y bajá a fast_economical para volumen alto o chat casual donde la latencia importa más que el último punto de calidad.

Qué modelo elegir

Antes de comparar proveedores uno por uno, esta es la lógica corta para llegar al tier correcto:

  • ¿El problema es genuinamente difícil? arquitectura, debugging profundo, matemática
    • flagship
    • No — ¿latencia o volumen importan más que el último punto de calidad?
      • fast_economical
      • No, es tarea general balanced
  • ¿Necesitás tool use (agentes, editar archivos, correr comandos)? filtrá por agentic_tools en cada ficha de proveedor
  • ¿Necesitás visión (imágenes/video)? Anthropic, Google, MiniMax M3 la soportan hoy

Razonamiento por proveedor, de un vistazo

Los ocho proveedores implementan "pensar antes de responder" de formas distintas — esta tabla resume el mecanismo de cada uno sin tener que entrar a las 8 fichas:

ProveedorMecanismoControl
Anthropic (Claude)AdaptativoEl modelo decide cuánto pensar según la tarea
OpenAI (GPT-5.x)Esfuerzo graduadolow/medium/high/xhigh, toda la familia razona
Google (Gemini)Budget (2.5) o level (3.x)Tokens de presupuesto explícito, o preset por nivel
DeepSeekToggle en el mismo modeloBooleano — sin SKUs separados
Z (GLM)Deep Thinking interleavedPor turno, incluso entre llamadas a herramientas
KimiSostenido entre tool callsPensado para agentes de código de varios pasos
MiniMaxAdaptive (M3) o siempre-on (M2.x)M3 se puede desactivar; M2.x razona siempre
Grok (xAI)Multi-agenteEl nivel de esfuerzo escala cuántos agentes colaboran

Elegí un proveedor

Cómo leer las fichas de cada modelo

TérminoQué significa
intelligence_tierflagship (el más capaz del proveedor) · balanced (equilibrio costo/calidad) · fast_economical (prioriza velocidad y precio)
speed_tierVelocidad relativa de respuesta: rápido / estándar / lento
Razonamiento graduadoNiveles tipo low/medium/high/xhigh — más esfuerzo, respuesta más deliberada, pero más tokens facturados
Razonamiento booleanoSolo se puede prender o apagar (on), sin niveles intermedios