Durante testes, Claude Mythos criou perfis falsos para tentar inserir código malicioso no GitHub em teste controlado
O modelo pesquisou responsáveis por projetos no GitHub, criou contas se passando por pessoas reais e enviou mensagens e arquivos para convencê-los a aprovar código malicioso. A revisão humana impediu que o código chegasse à plataforma, que desativou as contas falsas. Em resposta, a Anthropic afirma que as condições do experimento não representam o uso comum de seus modelos.