TokenGate
Documentación
docs / cli

CLI: Claude Code y Codex

TokenGate expone un proxy dedicado bajo /cli, separado del gateway público /v1, que habla el protocolo nativo de cada CLI en vez del dialecto genérico de chat completions. Así podés seguir usando Claude Code o Codex tal cual los conocés, pero pagando con tu saldo de TokenGate.

🖥️

Estas mismas instrucciones, ya con tu API key precargada y el base_url correcto, están en /dashboard/cli.

Claude Code vs Codex, de un vistazo

Claude Code Codex
Dialecto Nativo de Anthropic (/v1/messages) Exclusivamente la Responses API
Se configura Tres variables de entorno Por completo en ~/.codex/config.toml
Auth x-api-key + anthropic-version env_key en el TOML
Endpoint /cli/v1/messages /cli/v1/responses

Otras herramientas (Aider, Cline)

Cualquier CLI que hable el dialecto clásico de chat completions de OpenAI se configura con las variables de siempre — no necesita el proxy Anthropic-nativo ni la Responses API:

SHELL
export OPENAI_BASE_URL="https://tokengate.work/cli/v1"
export OPENAI_API_KEY="tg_live_..."
# elegí el modelo con el flag propio de cada CLI, ej:
aider --model <slug-del-modelo>

Estos requests llegan a POST /cli/v1/chat/completions.

Cosas a tener en cuenta (todas las herramientas)

Tool use es obligatorio

Un agente de código sin soporte de herramientas devuelve 400 tools_not_supported — elegí un modelo con agentic_tools en el catálogo.

Sin imágenes por ahora

El proxy CLI es solo texto en esta versión; los adjuntos de imagen no se transmiten.

Streaming + tools se bufferea

Cuando un request combina stream con llamadas a herramienta, TokenGate arma la respuesta completa y después la sintetiza como eventos SSE — correcto, pero sin texto token a token en esos turnos.

Prompt caching automático

Para DeepSeek, OpenAI, Kimi, GLM, MiniMax y Gemini. En Claude depende de que el modelo tenga precio de cache configurado en el panel admin.