TokenGate
Documentación
docs / cli

CLI: Claude Code y Codex

TokenGate expone un proxy dedicado bajo /cli, separado del gateway público /v1, que habla el protocolo nativo de cada CLI en vez del dialecto genérico de chat completions. Así podés seguir usando Claude Code o Codex tal cual los conocés, pero pagando con tu saldo de TokenGate.

🖥️

Estas mismas instrucciones, ya con tu API key precargada y el base_url correcto, están en /dashboard/cli.

Elegí tu herramienta

Otras herramientas (Aider, Cline)

Cualquier CLI que hable el dialecto clásico de chat completions de OpenAI se configura con las variables de siempre — no necesita el proxy Anthropic-nativo ni la Responses API:

export OPENAI_BASE_URL="https://tokengate.work/cli/v1"
export OPENAI_API_KEY="tg_live_..."
# elegí el modelo con el flag propio de cada CLI, ej:
aider --model <slug-del-modelo>

Estos requests llegan a POST /cli/v1/chat/completions.

Cosas a tener en cuenta (todas las herramientas)

  • Tool use es obligatorio para agentes de código. Si elegís un modelo sin soporte de herramientas, el proxy devuelve 400 tools_not_supported — elegí un modelo con agentic_tools en el catálogo.
  • Sin imágenes por ahora. El proxy CLI es solo texto en esta versión; adjuntos de imagen no se transmiten.
  • Streaming + tools se buffers primero. Cuando un request combina stream con llamadas a herramienta, TokenGate arma la respuesta completa sin streaming real y después la sintetiza como eventos SSE — el resultado es correcto, pero no vas a ver texto aparecer token a token en esos turnos.
  • Prompt caching automático para DeepSeek, OpenAI, Kimi, GLM, MiniMax y Gemini. En Claude depende de que el modelo tenga precio de cache configurado en el panel admin.