4

Acho que tem alguma falha de comunicação ou expectativa aí... Veja os comentários no HackerNews, vários declarando experiência positiva no dia do anúncio.

Além disso, eu usei em três projetos diferentes (que não são de baixo nível) e notei melhores resultados com custos menores em todos. Tanto comparando com o Opus 4.8 no effort padrão (não lembro qual era, talvez xhigh?) quanto no Sonnet 4.6. Sim, consegui fazer mais coisas por sessão com o Fable 5 do que com o Sonnet 4.6.

E a própria Anthropic disponibilizou um gráfico mostrando a diferença de acurácia por custo comparando Fable 5 e Opus 4.8:

Custos e acurácias do Opus 4.8 e Fable 5 em diferentes níveis de esforço

Vale ressaltar que mesmo o custo sendo mais alto para a mesma quantidade de tokens, ele pode ser mais econômico por gastar menos tokens, que foi o que notei na minha experiência. Usei pela assinatura do Claude, não pela API.

Carregando publicação patrocinada...
1

Entendo sua visão, mas recomendo que leia o estudo: https://export.arxiv.org/abs/2606.05405

Eu vou falar algo que talvez muitos não gostem, talvez o modelo seja bom para o que não é tão complexo assim... ou areas onde ele domina mais, que provavelmente é onde a massa esta usando mais, nem todo mundo realmente esta usando para tarefas realmente complexas, apesar de achar que está.