1

Bom ponto. Acho que a parte mais útil desse tipo de ajuste não é só economizar token, mas tornar o comportamento do agente mais previsível.

Uma coisa que eu ainda fico em dúvida é até onde vale remover ferramentas e contexto antes de começar a perder capacidade de investigação. Em tarefas pequenas parece ótimo, mas em debugging mais aberto talvez o custo maior no início evite algumas voltas erradas depois.

Você chegou a perceber alguma diferença na qualidade das respostas depois da redução, ou só no consumo inicial?

Carregando publicação patrocinada...
2

Conforme você usa, perceberá que tem coisas que não fazem diferença nenhuma pra você. Por exemplo, eu não uso nada relacionado a Cron ou Notebook.

Outras coisas até trazem valor, mas consomem muitos tokens. No meu uso, percebi que era o caso de Workflows. O Claude Code começou a ativar isso há poucas semanas sempre que eu solicitava revisão de código, e facilmente consumia 60k por agente, sendo que em alguns casos criava mais de 10 agentes de revisão. Eu sentia que o "custo por resultado" não compensava, por isso desativei. Para exemplificar, digamos que o resultado era 20% melhor e o custo era 300% maior.

Skills são outro exemplo. Se você nunca usou, provavelmente nunca usará, mas ainda pode só tirar a skill do contexto do agente e invocar ela manualmente.

E se achou que a configuração ficou pior, pode voltar a habilitar e reiniciar o Claude Code. Eu realmente sugiro testar porque é algo que varia de pessoa pra pessoa, e até do momento em que você está. Pode iniciar com algo mais simples e ir expandindo as ferramentas conforme entende elas melhor.