Cómo hacer que Claude Code funcione sin pagar la API de Anthropic
Claude Code es uno de los mejores agentes de terminal que existen. El problema no es usarlo — es la factura, si no tienes una suscripción Claude o no quieres poner una tarjeta en la API de Anthropic.
Hay una salida limpia: Claude Code habla un protocolo (la Anthropic Messages API), y cualquier cosa que hable ese protocolo sirve de motor por debajo. Puedes cambiar Anthropic por un modelo gratuito, un proveedor más barato, o un modelo local en tu portátil — sin tocar Claude Code en sí.
El camino corto: 4 variables de entorno
Claude Code lee el endpoint y la clave desde variables de entorno. Apúntalas a otro sitio:
``` export ANTHROPIC_BASE_URL="https://tu-gateway" export ANTHROPIC_AUTH_TOKEN="la-clave-del-gateway" export ANTHROPIC_MODEL="id-completo-del-modelo" export ANTHROPIC_DEFAULT_HAIKU_MODEL="id-completo-del-modelo-rapido" ```
Con esto, todas las llamadas de Claude Code van adonde tú digas — OpenRouter, DeepSeek, Gemini, Kimi K3, lo que quieras. El atajo `sonnet` solo funciona detrás de gateways que hacen proxy a Anthropic; en otros modelos, pon el ID completo.
El camino con router: `claude-code-router`
Si quieres alternar entre modelos por tarea, `claude-code-router` (de `musistudio`, 36 mil estrellas en GitHub, MIT, ya en la v3) es un gateway local que intercepta las peticiones de Claude Code y las reenvía a OpenAI, Gemini, DeepSeek, OpenRouter, Mistral, Moonshot y más. Corre en tu máquina, es gratuito, y las reglas son tuyas: modelo fuerte para escribir código, modelo barato para el resto.
Modelo local, cero cuentas
Desde enero de 2026 Ollama sirve la Anthropic Messages API directamente. Instalas Ollama, descargas un modelo, apuntas `ANTHROPIC_BASE_URL` a `localhost` — y Claude Code corre sin conexión, sin ninguna clave. LM Studio hace lo mismo.
The catch — lo que nadie te dice en el pie de foto
Tres cosas, y son reales:
- Modelo débil, agente débil. Claude Code depende mucho del tool calling — editar archivos, ejecutar comandos. El score de benchmark del modelo importa menos que la calidad del tool use. Los modelos de frontera aguantan; los débiles se lían en las ediciones y en los comandos de shell, y pasas más tiempo corrigiendo que produciendo.
- Deja de ser "gratis" en el sentido de tu suscripción. En cuanto activas un gateway, las sesiones se facturan como uso de API por ese backend. Tu suscripción Claude Pro/Max no cuenta ahí. "Sin pagar la API de Anthropic" no es lo mismo que "sin pagar nada" — a menos que el modelo sea local.
- Tu código pasa por un tercero. Un gateway en la nube ve todo lo que Claude Code lee y escribe. Antes de mandar código propietario por ahí, confirma dónde corre el gateway y qué guarda.
Cuándo compensa
- Aprender, experimentar, proyectos personales: router + modelo barato, u Ollama local. Compensa ya.
- Código de trabajo, con plazos: un modelo de frontera vía API suele salir más barato en tiempo perdido que un modelo débil "gratis".
- Código sensible: modelo local, o nada.
¿Quieres la versión tranquila de noticias de IA como esta, una vez por semana? Suscríbete a la newsletter de Sharp AI Hub →