Como pôr o Claude Code a correr sem pagar a API da Anthropic
O Claude Code é um dos melhores agentes de terminal que existem. O problema não é usá-lo — é a fatura, se não tens uma subscrição Claude ou não queres pôr um cartão na API da Anthropic.
Há uma saída limpa: o Claude Code fala um protocolo (a Anthropic Messages API), e qualquer coisa que fale esse protocolo serve de motor por baixo dele. Podes trocar a Anthropic por um modelo gratuito, um provedor mais barato, ou um modelo local no teu portátil — sem tocar no Claude Code em si.
O caminho curto: 4 variáveis de ambiente
O Claude Code lê o endpoint e a chave de variáveis de ambiente. Aponta-as para outro sítio:
``` export ANTHROPIC_BASE_URL="https://o-teu-gateway" export ANTHROPIC_AUTH_TOKEN="a-chave-do-gateway" export ANTHROPIC_MODEL="id-completo-do-modelo" export ANTHROPIC_DEFAULT_HAIKU_MODEL="id-completo-do-modelo-rapido" ```
Com isto, todas as chamadas do Claude Code passam a ir para onde tu mandares — OpenRouter, DeepSeek, Gemini, Kimi K3, o que quiseres. O `sonnet` como atalho só funciona atrás de gateways que fazem proxy à Anthropic; noutros modelos, mete o ID completo.
O caminho com router: `claude-code-router`
Se queres alternar entre modelos por tarefa, o `claude-code-router` (do `musistudio`, 36 mil estrelas no GitHub, MIT, já na v3) é um gateway local que intercepta os pedidos do Claude Code e reencaminha-os para OpenAI, Gemini, DeepSeek, OpenRouter, Mistral, Moonshot e mais. Corre na tua máquina, é gratuito, e as regras são tuas: modelo forte para escrever código, modelo barato para o resto.
Modelo local, zero contas
Desde janeiro de 2026 o Ollama serve a Anthropic Messages API diretamente. Instalas o Ollama, puxas um modelo, apontas o `ANTHROPIC_BASE_URL` para `localhost` — e o Claude Code corre offline, sem chave nenhuma. O LM Studio faz o mesmo.
The catch — o que ninguém te diz na legenda
Três coisas, e são reais:
- Modelo fraco, agente fraco. O Claude Code depende muito de tool calling — editar ficheiros, correr comandos. O score de benchmark do modelo importa menos do que a qualidade de tool use. Modelos de fronteira aguentam; os fracos atrapalham-se nas edições e nos comandos de shell, e passas mais tempo a corrigir do que a produzir.
- Deixa de ser "grátis" no sentido da tua subscrição. Assim que ativas um gateway, as sessões são faturadas como uso de API por esse backend. A tua subscrição Claude Pro/Max não conta ali. "Sem pagar a API da Anthropic" não é o mesmo que "sem pagar nada" — a menos que o modelo seja local.
- O teu código passa por um terceiro. Um gateway na cloud vê tudo o que o Claude Code lê e escreve. Antes de mandares código proprietário por lá, confirma onde o gateway corre e o que ele guarda.
Quando é que isto compensa
- Aprender, experimentar, projetos pessoais: router + modelo barato, ou Ollama local. Compensa já.
- Código de trabalho, com prazos: um modelo de fronteira via API costuma sair mais barato em tempo perdido do que um modelo fraco "grátis".
- Código sensível: modelo local, ou nada.
Queres a versão calma de notícias de IA como esta, uma vez por semana? Subscreve a newsletter do Sharp AI Hub →