CLI: Claude Code y Codex
TokenGate expone un proxy dedicado bajo /cli, separado del gateway público /v1, que habla el protocolo nativo de cada CLI en vez del dialecto genérico de chat completions. Así podés seguir usando Claude Code o Codex tal cual los conocés, pero pagando con tu saldo de TokenGate.
Estas mismas instrucciones, ya con tu API key precargada y el base_url correcto, están en /dashboard/cli.
Elegí tu herramienta
Configurar Claude Code
Habla el dialecto nativo de Anthropic. Se configura con tres variables de entorno.
CodexConfigurar Codex CLI
Habla exclusivamente la Responses API. Se configura por completo en ~/.codex/config.toml.
Otras herramientas (Aider, Cline)
Cualquier CLI que hable el dialecto clásico de chat completions de OpenAI se configura con las variables de siempre — no necesita el proxy Anthropic-nativo ni la Responses API:
export OPENAI_BASE_URL="https://tokengate.work/cli/v1"
export OPENAI_API_KEY="tg_live_..."
# elegí el modelo con el flag propio de cada CLI, ej:
aider --model <slug-del-modelo>
Estos requests llegan a POST /cli/v1/chat/completions.
Cosas a tener en cuenta (todas las herramientas)
- Tool use es obligatorio para agentes de código. Si elegís un modelo sin soporte de herramientas, el proxy devuelve
400 tools_not_supported— elegí un modelo con agentic_tools en el catálogo. - Sin imágenes por ahora. El proxy CLI es solo texto en esta versión; adjuntos de imagen no se transmiten.
- Streaming + tools se buffers primero. Cuando un request combina
streamcon llamadas a herramienta, TokenGate arma la respuesta completa sin streaming real y después la sintetiza como eventos SSE — el resultado es correcto, pero no vas a ver texto aparecer token a token en esos turnos. - Prompt caching automático para DeepSeek, OpenAI, Kimi, GLM, MiniMax y Gemini. En Claude depende de que el modelo tenga precio de cache configurado en el panel admin.