1

Muito obrigado pelo feedback e pelo entusiasmo, @EduardoWorrel! Fico muito feliz que o post tenha ressoado com o que você vem explorando.

Gerenciar modelos pesados no browser com WebGPU/ONNX e lidar com limitações de VRAM/WASM realmente é um território cheio de nuances e desafios práticos. Adoraria trocar ideias sobre a sua experiência com o criador do transformers.js e do WebMCP — com certeza temos muito o que somar!

Sobre o seu teste com o Claude Code SDK: o trade-off entre custo/latência de LLMs e a execução rápida das ferramentas locais é justamente um dos motivos pelos quais desenhamos o motor compartilhado entre CLI/Agent e o runtime local.

Sim, temos nossa comunidade oficial no Discord! Você é super bem-vindo para entrar e continuar o papo por lá:
👉 https://discord.gg/M22hsydVh

Nos vemos lá! 🚀

Carregando publicação patrocinada...