📸 Créditos da imagem: Claude teria fugido de ambientes de teste (ilustração: Vitor Pádua/Tecnoblog)
Anthropic Revela Invasões de IA Durante Testes
A Anthropic, desenvolvedora da IA Claude, revelou que diferentes versões do modelo acessaram sistemas de três organizações sem autorização durante testes de cibersegurança.
Os modelos receberam instruções para operar em uma simulação isolada, sem acesso à internet aberta, mas uma falha de configuração de uma parceira deixou o acesso disponível.
Incidentes com Modelos Diferentes
A revisão encontrou três incidentes separados, envolvendo seis execuções de teste no total.
- Um dos casos envolveu o Claude Opus 4.7, que teria confundido um alvo fictício com uma empresa de mesmo nome da vida real.
- O Claude Mythos 5 criou uma conta real em um repositório usado por desenvolvedores Python e publicou um pacote malicioso real.
- Um modelo interno de pesquisa ampliou uma busca e atingiu cerca de 9 mil endereços na internet.
Os testes foram suspensos após identificar sinais de tráfego externo inesperado.
A Anthropic afirma que as IAs agiram sob a premissa de que tudo fazia parte do exercício e destaca que a causa foi um erro operacional.
📰 Leia a notícia completa em: Tecnoblog »