23 Dicas
A conferência de inteligência artificial mais futurista da Índia está de volta – maior, mais afiada e mais ousada. O uso de Claude Code em projetos grandes pode levar a custos de token astronômicos. Um estudo de 2025 da Universidade de Stanford revela que os desenvolvedores desperdiçam milhares de tokens diariamente, esgotando os orçamentos à medida que os limites de contexto não verificados se acumulam. Ao estabelecer limites rigorosos desde o início, as equipes podem reduzir os custos sem comprometer a qualidade do código. A otimização do uso de tokens e do tamanho da janela de contexto no início garante a eficiência e mantém os projetos no trilho. Neste artigo, vamos dividir as principais etapas para economizar tokens de Claude Code e gerenciar os custos da API.
À medida que o contexto da conversa se expande, também aumentam os custos dos tokens. Isso inclui não apenas leituras de arquivos e saídas de comandos, mas também instruções do sistema e histórico de conversa. De acordo com a Anthropic, os custos dos tokens aumentam à medida que o tamanho do contexto cresce. Para evitar despesas desnecessárias, é fundamental manter o contexto de trabalho compacto. Ao otimizar os tamanhos da janela de contexto desde o início, você pode gerenciar melhor o uso de tokens e manter os custos sob controle em projetos. Limpe a conversa ao mudar de tarefas. Digite /clear para iniciar uma nova sessão. Isso evita que registros de depuração antigos desperdicem tokens. Você reduz o custo do Claude Code iniciando do zero.
Use o comando /compact para tarefas longas. Essa ação resume a conversa. Ela mantém a thread, mas descarta dados antigos. Isso melhora os esforços de economia de tokens do Claude Code. Adicione instruções personalizadas ao arquivo CLAUDE.md: no código Claude, use o comando /compact para compactar a conversa mais cedo do que o limite padrão. O Claude compacta perto de 95% da capacidade. Defina um override para 70 para trabalho normal. Use 50 para workflows barulhentos. Essa tática ajuda a gerenciar o uso de tokens. Monitore os limites com comandos específicos. Digite /context para ver o que consome espaço. Digite /usage para rastrear os gastos da sessão. Execute esses comandos antes de tarefas grandes para otimizar o espaço da janela de contexto.
Adicione uma linha de status ao terminal. Isso mostra o percentual de contexto e os custos do modelo em tempo real. Isso evita picos inesperados de tokens. Isso melhora a experiência do assistente de codificação de IA. Use essa configuração JSON no arquivo ~/.claude/settings.json ou você pode ter o Claude Code criar isso automaticamente executando esse comando dentro da conversa do Claude Code: Mantenha o arquivo de instruções principal curto. A Anthropic sugere manter o arquivo CLAUDE.md com menos de 200 linhas. Arquivos grandes custam tokens a cada sessão. Armazene apenas fatos cruciais lá. Essa estratégia melhora a economia de tokens do Claude Code. Use regras com escopo de caminho em vez de globais. Coloque regras específicas em pastas. Essas regras carregam apenas quando o Claude edita arquivos correspondentes. Você reduz o custo do Claude Code escondendo instruções irrelevantes.
Para usar regras com escopo de caminho no Claude Code, você deve adicioná-las a um arquivo de marcação dentro do diretório .claude/rules/ do seu projeto. Crie um novo arquivo .md dentro da pasta de regras. Uma convenção de nomenclatura comum é nomeá-lo após o subsistema que ele rege: .claude/rules/api-validation.md (ou qualquer nome que termine em .md). Mova fluxos de trabalho especializados para habilidades distintas. Habilidades carregam sob demanda. Adicione uma flag de desabilitação para escondê-las até que sejam necessárias. Isso mantém o prompt limpo. Isso ajuda a gerenciar o uso de tokens. Você pode adicionar a habilidade do Claude em .claude/skills/
Preferir ferramentas de linha de comando em vez de ferramentas de servidor. A Anthropic prefere ferramentas padrão em vez de servidores MCP. Ferramentas de linha de comando causam menos sobrecarga. Desative servidores MCP não utilizados de uma vez. Isso otimiza o assistente de codificação de IA. Bom prompt: use gh para inspecionar PR 42 e retornar apenas os nomes de verificações que falharam. Limite o tamanho da saída das ferramentas. As saídas das ferramentas inundam o contexto da conversa. Defina o limite máximo para 8000. Você otimiza o espaço da janela de contexto dessa forma. Limite a saída do comando do terminal. Registros de teste longos esgotam tokens rapidamente. Defina o comprimento da saída do bash para 20000. Isso garante a economia de tokens do Claude Code. Filtrar as saídas de log antes que o Claude as veja. Não alimente logs brutos na conversa. Use comandos básicos para extrair linhas de erro. Essa etapa ajuda a reduzir o custo do Claude Code.
Se você quiser iniciar uma sessão completa com os logs filtrados pré-carregados no contexto, pipe a saída para o comando padrão do Claude. Inicie o Claude Code com o seguinte comando: Implemente subagentes para tarefas de pesquisa verbosas. Subagentes lidam com leituras pesadas em um espaço isolado. Eles retornam resumos limpos para a conversa principal. Isso ajuda a gerenciar o uso de tokens. Se você realizar, digamos, uma tarefa de investigador com frequência, você pode definir um subagente permanente criando um arquivo MD em .claude/agents/investigator.md. Ap