CLI: Claude Code y Codex
TokenGate expone un proxy dedicado bajo /cli, separado del gateway público /v1, que habla el protocolo nativo de cada CLI en vez del dialecto genérico de chat completions. Así podés seguir usando Claude Code o Codex tal cual los conocés, pero pagando con tu saldo de TokenGate.
Estas mismas instrucciones, ya con tu API key precargada y el base_url correcto, están en /dashboard/cli.
Claude Code vs Codex, de un vistazo
/v1/messages)
Exclusivamente la Responses API
~/.codex/config.toml
x-api-key + anthropic-version
env_key en el TOML
/cli/v1/messages
/cli/v1/responses
Configurar Claude Code
Habla el dialecto nativo de Anthropic. Se configura con tres variables de entorno.
CodexConfigurar Codex CLI
Habla exclusivamente la Responses API. Se configura por completo en ~/.codex/config.toml.
Otras herramientas (Aider, Cline)
Cualquier CLI que hable el dialecto clásico de chat completions de OpenAI se configura con las variables de siempre — no necesita el proxy Anthropic-nativo ni la Responses API:
export OPENAI_BASE_URL="https://tokengate.work/cli/v1"
export OPENAI_API_KEY="tg_live_..."
# elegí el modelo con el flag propio de cada CLI, ej:
aider --model <slug-del-modelo>Estos requests llegan a POST /cli/v1/chat/completions.
Cosas a tener en cuenta (todas las herramientas)
Tool use es obligatorio
Un agente de código sin soporte de herramientas devuelve 400 tools_not_supported — elegí un modelo con agentic_tools en el catálogo.
Sin imágenes por ahora
El proxy CLI es solo texto en esta versión; los adjuntos de imagen no se transmiten.
Streaming + tools se bufferea
Cuando un request combina stream con llamadas a herramienta, TokenGate arma la respuesta completa y después la sintetiza como eventos SSE — correcto, pero sin texto token a token en esos turnos.
Prompt caching automático
Para DeepSeek, OpenAI, Kimi, GLM, MiniMax y Gemini. En Claude depende de que el modelo tenga precio de cache configurado en el panel admin.