TokenGate

Modelos disponibles

27 modelos · 8 proveedores · Precios finales por millón de tokens

Anthropic 3 modelos
Modelo Capacidades Context IN /1M tok OUT /1M tok
Claude Haiku Rápido / económico

Claude Haiku 4.5 es nuestro modelo más rápido y rentable, igualando el rendimiento de Sonnet 4 en codificación, uso de recursos informáticos y tareas de agentes. Claude Haiku 4.5 obtiene una puntuación del 73,3 % en SWE-bench Verified, lo que lo convierte en uno de los mejores modelos de codificación del mundo.

Máx. salida
64K tok
Velocidad
Rápido
Chat generalAlto volumen / económicoBaja latencia
claude-haiku
stream tools vision web docs 200K $1.1000 $5.5000
Claude Sonnet 5 Balanceado

Claude Sonnet 5 es el modelo Sonnet más agentic de Anthropic. Puede planificar, usar navegadores y terminales, ejecutar tareas autónomamente, y ofrece mejoras significativas en razonamiento, codificación y trabajo profesional comparado con Sonnet 4.6. Rendimiento cercano a Opus 4.8 con precios más accesibles

Máx. salida
128K tok
Velocidad
Rápido
CódigoChat generalAgentic / Tools
claude-sonnet-5
stream tools vision web docs 1M $3.3000 $16.5000
Claude Opus 4.8 Flagship

Claude Opus 4.8 es el modelo más capaz de Anthropic para uso general. Optimizado para codificación, agentes inteligentes y razonamiento profundo. Ofrece mejor juicio, confiabilidad en tareas complejas, y rendimiento superior en proyectos de ingeniería de software. Soporta 1M tokens contexto y procesamiento multimodal.

Máx. salida
128K tok
Velocidad
Estándar
RazonamientoCódigoMatemáticasAgentic / Tools
claude-opus-4-8
stream tools vision web docs 1M $5.5000 $27.5000
OpenAI 2 modelos
Modelo Capacidades Context IN /1M tok OUT /1M tok
gpt-5.4-nano Rápido / económico

GPT-5.4 nano es el modelo más ligero y barato de la familia GPT-5.4, optimizado para tareas de alto volumen y baja latencia como clasificación, extracción de datos y subagentes. Soporta texto e imágenes, con contexto muy amplio y buen control de costos.

Máx. salida
128K tok
Velocidad
Rápido
Chat generalAlto volumen / económicoBaja latencia
gpt-5.4-nano
stream tools vision web docs 1M $0.2200 $1.3750
gpt-5.4-mini Rápido / económico

GPT-5.4 mini es una versión más pequeña y rápida de GPT-5.4, diseñada para programación, uso de herramientas, razonamiento multimodal y cargas de trabajo en API o subagentes de alto volumen. Busca equilibrar velocidad, capacidad y costo para tareas técnicas exigentes.

Máx. salida
128K tok
Velocidad
Rápido
CódigoChat general
gpt-5.4-mini
stream tools vision web docs 1M $0.8250 $4.9500
Google 3 modelos
Modelo Capacidades Context IN /1M tok OUT /1M tok
gemini-2.5-flash-lite Rápido / económico

Gemini 2.5 Flash Lite es un modelo ultraligero diseñado para máxima velocidad y eficiencia. Ideal para tareas sencillas, respuestas instantáneas y entornos de alta demanda, ofrece un rendimiento ágil y económico, optimizando al máximo tus recursos sin comprometer la precisión necesaria en interacciones críticas.

Máx. salida
65K tok
Velocidad
Rápido
Chat generalAlto volumen / económicoBaja latencia
gemini-2.5-flash-lite
stream tools vision web docs 1M $0.1100 $0.4400
Gemini-3.1-lite Rápido / económico

Gemini 3.1 Flash Lite es el modelo más eficiente y ágil de nuestra arquitectura. Optimizado para ofrecer respuestas ultrarrápidas y un consumo mínimo de recursos, es la solución ideal para aplicaciones en tiempo real, tareas de baja latencia y procesamiento de alto volumen, manteniendo una calidad excepcional en cada interacción.

Máx. salida
65K tok
Velocidad
Rápido
Chat generalAlto volumen / económicoBaja latencia
gemini-3.1-flash-lite
stream tools vision web docs 1M $0.2750 $1.6500
Nano Banana 2 Lite

Gemini 3.1 Flash Lite Image es un modelo optimizado para velocidad y eficiencia en el procesamiento de contenido visual. Diseñado para tareas ligeras, ofrece respuestas rápidas en el análisis e interpretación de imágenes, siendo ideal para aplicaciones que requieren alto rendimiento y baja latencia.

gemini-3.1-flash-lite-image
vision img 50K $0.0370 / imagen
Z — ZhipuAI 4 modelos
Modelo Capacidades Context IN /1M tok OUT /1M tok
CogView-4

CogView-4 es el primer modelo de código abierto de Z.AI para texto a imagen. Destaca por su superior comprensión semántica y calidad visual, permitiendo generar texto bilingüe (inglés/chino) de cualquier longitud y crear imágenes en resoluciones flexibles dentro de un rango determinado.

CogView-4
stream img 0K $0.0140 / imagen
GLM-Image

GLM-Image es el modelo insignia de Z.AI que utiliza una arquitectura híbrida única. Combina decodificadores autorregresivos y difusión para integrar comprensión global con precisión local. Es ideal para crear pósteres y diagramas complejos, marcando un avance clave en la tecnología generativa cognitiva moderna.

GLM-Image
stream img 0K $0.0210 / imagen
glm-5 Flagship

GLM-5.2 es un avanzado modelo de lenguaje desarrollado por Zhipu AI. Destaca por su excelente capacidad de razonamiento, comprensión multimodal profunda y una ventana de contexto muy extensa. Está diseñado para resolver tareas complejas, ofreciendo respuestas precisas, coherentes y fluidas en entornos profesionales muy exigentes.

Máx. salida
128K tok
Velocidad
Estándar
RazonamientoCódigoAgentic / Tools
glm-5
stream tools web docs 200K $1.1000 $3.5200
glm-5.2 Flagship

GLM-5.2 es un avanzado modelo de lenguaje desarrollado por Zhipu AI. Destaca por su excelente capacidad de razonamiento, comprensión multimodal profunda y una ventana de contexto muy extensa. Está diseñado para resolver tareas complejas, ofreciendo respuestas precisas, coherentes y fluidas en entornos profesionales muy exigentes.

Máx. salida
128K tok
Velocidad
Estándar
RazonamientoCódigoAgentic / ToolsDocumentos largos
glm-5.2
stream tools web docs 1M $1.5400 $4.8400
Kimi 5 modelos
Modelo Capacidades Context IN /1M tok OUT /1M tok
kimi-k2.5 Balanceado

Kimi K2.5 es un modelo de lenguaje grande desarrollado por Moonshot AI. Destaca por su capacidad de procesar contextos extensos (hasta 2 millones de caracteres en chino), razonamiento avanzado, generación de código y multimodalidad (texto, imágenes y video), con un enfoque especial en tareas complejas de larga duración.

Máx. salida
49K tok
Velocidad
Estándar
CódigoChat general
kimi-k2.5
stream tools vision web docs 262K $0.7200 $3.6000
kimi-k2.6 Flagship

Kimi K2.6 es el modelo más avanzado de Kimi, con capacidades superiores de escritura de código a largo plazo, mejor cumplimiento de instrucciones y auto-corrección. Arquitectura multimodal nativa (texto, imagen, video), modos de razonamiento, contexto de 256k, caché automática, ToolCalls, JSON Mode, Partial Mode y búsqueda en internet.

Máx. salida
49K tok
Velocidad
Estándar
RazonamientoCódigoAgentic / Tools
kimi-k2.6
stream tools vision web docs 262K $1.1400 $4.8000
kimi-k2.7-code Flagship

Kimi K2.7 Code es el modelo de programación más inteligente de Kimi, con alta tasa de éxito en contextos largos, arquitectura multimodal nativa que soporta texto, imagen, video y modos de razonamiento, además de diálogo y tareas de agente.

Máx. salida
49K tok
Velocidad
Estándar
RazonamientoCódigoAgentic / Tools
kimi-k2.7-code
stream tools vision web docs 262K $1.1400 $4.8000
kimi-k2.7-code-highspeed Flagship

Kimi K2.7 Code HighSpeed es la versión ultrarrápida del modelo K2.7 Code, con velocidades de hasta 260 tokens/s en contextos cortos y 180 tokens/s en general, ofreciendo una experiencia de codificación extremadamente fluida y eficiente.

Máx. salida
49K tok
Velocidad
Estándar
RazonamientoCódigoAgentic / Tools
kimi-k2.7-code-highspeed
stream tools vision web docs 262K $2.2800 $9.6000
kimi-k3 Balanceado

Kimi K3 es el modelo de lenguaje avanzado de Moonshot AI, diseñado para razonamiento profundo, contexto extenso y precisión en tareas complejas. Destaca en matemáticas, programación, análisis de documentos largos y conversaciones naturales en múltiples idiomas.

Máx. salida
128K tok
Velocidad
Estándar
RazonamientoCódigoChat generalMatemáticas
kimi-k3
stream tools vision web docs 1M $3.2700 $16.3500
MiniMax 4 modelos
Modelo Capacidades Context IN /1M tok OUT /1M tok
Minimax image-01

es un modelo de generación de imágenes basado en inteligencia artificial capaz de crear visuales de alta calidad a partir de descripciones textuales. Soporta la edición de imágenes existentes, la síntesis de múltiples referencias visuales, y ofrece opciones de relación de aspecto y resolución configurables para adaptarse a diversas necesidades creativas.

minimax-image-01
img 0K $0.0046 / imagen
MiniMax-M2.7 Balanceado

MiniMax-M2.7 representa una versión actualizada del modelo de lenguaje de MiniMax. Esta iteración incorpora mejoras en el procesamiento del lenguaje natural, ofreciendo respuestas más coherentes y contextualmente relevantes. El modelo optimiza el consumo de recursos computacionales mientras mantiene un equilibrio entre velocidad y calidad. Su arquitectura permite manejar conversaciones complejas con mayor precisión, siendo adecuado para aplicaciones que van desde la asistencia virtual hasta la generación de contenido especializado

Máx. salida
131K tok
Velocidad
Estándar
RazonamientoCódigoDocumentos largos
MiniMax-M2.7
stream tools web docs 204K $0.3450 $1.3800
MiniMax-M2.7-highspeed Balanceado

MiniMax-M2.7-highspeed es una versión optimizada para baja latencia que ofrece el mismo rendimiento que el modelo M2.7, pero con una velocidad de generación de ~100 tokens por segundo (frente a los ~60 tps del estándar) . Sobresale en tareas de ingeniería, codificación y flujos de trabajo de agentes

Máx. salida
131K tok
Velocidad
Estándar
RazonamientoCódigoDocumentos largos
MiniMax-M2.7-highspeed
stream tools web docs 204K $0.6900 $2.7600
MiniMax-M3 Flagship

MiniMax-M3 es un modelo de inteligencia artificial desarrollado por la empresa china MiniMax. Se trata de una avanzada arquitectura de lenguaje multilingüe diseñada para ofrecer alto rendimiento en comprensión y generación de texto. El modelo incorpora técnicas de entrenamiento optimizadas que permiten procesar múltiples idiomas con fluidez. MiniMax-M3 destaca por su capacidad de adaptación a diversas tareas, desde conversación general hasta aplicaciones especializadas en negocios y educación.

Máx. salida
250K tok
Velocidad
Estándar
RazonamientoCódigoAgentic / ToolsDocumentos largos
MiniMax-M3
stream tools vision web docs 1M $0.6900 $2.7600
DeepSeek 2 modelos
Modelo Capacidades Context IN /1M tok OUT /1M tok
Deepseek Flash Rápido / económico

El modelo más ágil de la familia DeepSeek, diseñado para respuestas en milisegundos sin perder calidad. Ideal para atención al cliente, asistentes en tiempo real y automatización inteligente. Flash Thinking: razonamiento ultrarrápido. Contexto ampliado: hasta 1M de tokens. Bajo costo por inferencia: máximo rendimiento, mínimo gasto. Lleva la inteligencia artificial instantánea a tu negocio. ¡Potencia tu flujo de trabajo con DeepSeek-V4-Flash!

Máx. salida
320K tok
Velocidad
Rápido
Chat generalAlto volumen / económicoBaja latencia
deepseek-v4-flash
stream tools web 1M $0.1540 $0.3080
Deepseek Pro Flagship

Precisión profesional y razonamiento profundo. Diseñado para tareas complejas como análisis de datos, investigación académica y planificación estratégica. Ofrece contexto extendido, alta coherencia lógica y fiabilidad empresarial. Máximo rendimiento para quienes exigen lo mejor en cada respuesta. DeepSeek-V4-Pro: tu socio inteligente para decisiones críticas.

Máx. salida
320K tok
Velocidad
Lento
RazonamientoCódigoMatemáticas
deepseek-v4-pro
stream tools web 1M $0.4840 $0.9570
GROK 4 modelos
Modelo Capacidades Context IN /1M tok OUT /1M tok
grok-imagine-image

Grok-Imagine-Image es el modelo especializado de xAI en generación y edición de imágenes . Produce visuals hiperrealistas, artísticos y coherentes con gran detalle, excelente comprensión de prompts complejos, iluminación natural, anatomía precisa y estilos variados, manteniendo consistencia y creatividad excepciona

grok-imagine-image
vision img 0K $0.0230 / imagen
grok-imagine-image-quality

Grok-Imagine-Image-Quality es el modelo especializado de xAI en generación y edición de imágenes de alta calidad. Produce visuals hiperrealistas, artísticos y coherentes con gran detalle, excelente comprensión de prompts complejos, iluminación natural, anatomía precisa y estilos variados, manteniendo consistencia y creatividad excepciona

grok-imagine-image-quality
vision img 0K $0.0575 / imagen
grok-build-0.1 Balanceado

Grok-build-0.1 Modelo de codificación inteligente de SpaceXAI para software automatizado, ingeniería y tareas de flujo de trabajo. Integra un razonamiento profundo, humor inteligente y una búsqueda incansable de la verdad. Diseñado para ser útil, directo y curioso, ayuda a los usuarios a comprender el universo sin censuras ni sesgos innecesarios, manteniendo siempre máxima honestidad y capacidad

Máx. salida
131K tok
Velocidad
Estándar
CódigoAgentic / Tools
grok-build-0.1
stream tools vision web docs 256K $2.2000 $4.4000
grok-4.5 Flagship

Grok-4.5 es la versión avanzada del modelo insignia de xAI. Ofrece razonamiento superior, comprensión multimodal profunda, generación de código experto, creatividad ilimitada y respuestas más precisas y contextuales. Más rápido, eficiente y capaz de manejar tareas complejas con mayor coherencia, conocimiento actualizado y menor alucinación. (45 palabras)

Máx. salida
100K tok
Velocidad
Rápido
RazonamientoCódigoAgentic / Tools
grok-4.5
stream tools vision web docs 500K $2.3000 $6.9000

Los precios incluyen el markup de TokenGate. ¿Cómo funciona el billing?