Pitch: Leash — sandbox open source que mostra exatamente o que seu agente de IA está enviando pela rede
Devido ao último incidente que ocorreu com o Grok CLI, escrevi uma sandbox pra saber de verdade o que roda e o que acontece na minha rede quando um agente de IA tá com controle do terminal.
O que tem de especial:
- descriptografa cada request HTTPS via mitmproxy e aplica uma allowlist de domínios — qualquer coisa fora da lista é bloqueada e logada
- monitora syscalls com Falco (eBPF) — pega leitura de credencial, tentativa de escape, bypass de rede
- tem um dashboard web pra ver tudo em tempo real e gerenciar a allowlist sem editar YAML na mão
Construí em torno do meu cenário: meu host é macOS ARM, então uso uma VM Lima pra isolar de verdade — os agentes (Claude Code, Codex, Gemini, Grok) rodam lá dentro sem acesso direto à internet, só através do proxy.
Se alguém quiser testar, apontar problemas, sugestões, contribuir, sejam muito bem vindos!
MIT license, código aberto.
github.com/thiagolmoraes/leash