1

O rombo do custo e a dívida de compreensão, no meu caso, tiveram a mesma raiz: critério escrito depois do código. Hoje a IA só pega uma tarefa se o aceite couber num teste que dê pra julgar só pelo diff, e quando eu não conseguia formular isso o buraco estava na minha especificação.

Na conta foi igual: só descobri que 62% das minhas queries pagavam uma etapa de avaliação sem precisar depois que medi, nunca por bom senso. Ainda tô apanhando nisso, e por enquanto o que funciona aqui é tirar do modelo tudo que é determinístico e rodar o resto num Qwen local, onde o custo para de variar e vira conta de luz.

Carregando publicação patrocinada...