1

Top demais! esse post menciona todas as palavras chave que me interessam muito!

Estou ansioso para contrastar com o que ja fiz para saber se tem algo que eu possa somar!

em especial no que diz respeito a gerenciamento de modelos grandes no navegador e suas peculiaridades são coisas que eu amaria discutir, tive a oportunidade de trocar ideia e discutir algumas questões sobre performance e limitações com o criador do transformers.js e o criador do WebMCP)

https://discord.com/channels/654562858780196864/760734765912555557/1364467614776164405

https://discord.com/channels/654562858780196864/760734765912555557/1365436076293886053

recentemente rodei um experimento do claude code SDK editar um video com linguagem natural dado um conjunto de ferramentas, o resultado foi interessante mas lento e caro, algo me fez desistir pelo caminho.

enfim, voces tem discord? entrei em um aqui mas não parece ter nada a ver hehe

Carregando publicação patrocinada...
1

Muito obrigado pelo feedback e pelo entusiasmo, @EduardoWorrel! Fico muito feliz que o post tenha ressoado com o que você vem explorando.

Gerenciar modelos pesados no browser com WebGPU/ONNX e lidar com limitações de VRAM/WASM realmente é um território cheio de nuances e desafios práticos. Adoraria trocar ideias sobre a sua experiência com o criador do transformers.js e do WebMCP — com certeza temos muito o que somar!

Sobre o seu teste com o Claude Code SDK: o trade-off entre custo/latência de LLMs e a execução rápida das ferramentas locais é justamente um dos motivos pelos quais desenhamos o motor compartilhado entre CLI/Agent e o runtime local.

Sim, temos nossa comunidade oficial no Discord! Você é super bem-vindo para entrar e continuar o papo por lá:
👉 https://discord.gg/M22hsydVh

Nos vemos lá! 🚀