Meus 2 cents,
Parar de tentar forcar o modelo a se comportar bem apenas com textao e colocar essas regras na camada de execucao ajuda um bocado.
Ainda gosto do uso de SDD (principamente quanto a orientacoes especificas sobre banco de dados, entidades, atributos e detalhes sobre a stack que estou usando) e sobre os testes a serem implementados, mas entendo o ponto de vista que voce colocou.
Apesar de um pouco artesanal, tenho usado a tecnica de "ativar" agents/claude/skills dependendo da tarefa que vou fazer (para plan, implementacao e manutencao, p.ex.) via script bash antes de chamar o agente (tentando evitar lixo em tarefas nao relacionadas).
E guardrails ainda sao um mal necessario, principalmente no nivel operacional - nao consigo fazer nada com agentes sem usar containers (ate agora nao vazaram, como diversas noticias vira-e-mexe informam).
voce tem visto/usado algum framework especifico para gerenciar essa memoria e contexto progressivo no dia a dia, ou so delega ao agente ?
Saude e Sucesso !
Este post foi favoritado via extensão TABNEWS FAVORITOS
Tem curiosidade sobre IA ? Da uma olhada no meu LIVRO: IA PARA ENGENHEIROS