Falhas no ChatGPT Atlas e Claude permitem ataques sem cliques e roubo de contas

📡 Fonte: Tecmundo 🏷️ Inteligência Artificial 🤖 Auto
Falhas no ChatGPT Atlas e Claude permitem ataques sem cliques e roubo de contas

📸 Créditos da imagem: Esquema montado pelos pesquisadores (Reprodução/Zenity)

Falhas no ChatGPT Atlas e Claude permitem ataques sem cliques e roubo de contas.

ChatGPT Atlas e o Claude in Chrome, que auxiliam a navegação web com IA, apresentam falhas graves que permitem o controle remoto de contas e dados de usuários sem que seja necessário clicar em nenhum link suspeito.

Problema Central

O problema central acontece porque o agente de IA lê conteúdos da internet e executa tarefas no lugar do usuário, utilizando exatamente as mesmas sessões em que a pessoa já está conectada e autenticada.

Quando um invasor planta instruções escondidas em uma página web, em um e-mail ou em uma postagem, a inteligência artificial confunde o comando externo com um pedido legítimo do próprio dono da conta.

Ataques ao ChatGPT Atlas

No caso do ChatGPT Atlas, os testes detalhados pelo pesquisador de segurança Stav Cohen mostraram que o sistema possui barreiras baseadas em classificadores que funcionam apenas como rótulos maleáveis, e não como barreiras técnicas definitivas.

Os profissionais conseguiram plantar um comentário em uma postagem que redirecionava o navegador para um site malicioso quando a vítima pedia algo simples, como se inscrever em uma newsletter.

Ataques ao Claude in Chrome

A pesquisa conduzida por Raul Klugman-Onitza e João Donato contra a extensão Claude in Chrome, da Anthropic, focou na exploração da ferramenta de execução de código fornecida pelo assistente.

Os especialistas realizaram a extração completa de e-mails do Gmail, obtiveram acesso persistente ao Google Drive e compartilharam arquivos da vítima com contas controladas pelos invasores.

Resposta das Empresas

A Zenity relatou as descobertas para a OpenAI e a Anthropic no final de 2025 e início de 2026.

A criadora do ChatGPT reconheceu, em fevereiro deste ano, que existem “riscos significativos associados à injeção de prompt em ambientes dos agentes” e afirmou que a resistência a esse tipo de falha é uma área contínua de trabalho.

A Anthropic encerrou os relatórios enviados via HackerOne sem conceder recompensas e afirmou nos registros de divulgação da Zenity que o material era inelegível para o programa de vulnerabilidades.

📰 Leia a notícia completa em: Tecmundo »

⚖️ Direitos Autorais: Este site utiliza conteúdo agregado automaticamente de fontes públicas. Todas as imagens possuem crédito e fonte indicados conforme exigido pela legislação brasileira de direitos autorais (Lei 9.610/98).