Ótimo ver quota do provedor tratada como falha prevista. Uma sugestão: um orçamento por especificação (tokens ou custo estimado) que interrompe a execução de forma limpa antes de esgotar a quota, e o consumo real gravado junto do artefato de revisão. Assim dá para comparar quanto cada spec custou e ajustar o tamanho das tarefas. O Daedalus já registra tokens por execução?
4
1
A idéia é interessante.
Estou trabalhando em métricas de execução que acompanhem tempo, uso de tokens, recorrência de loops, chamadas à api do provedor. Estou fazendo uma UI com htmx para exibir as métricas.