OpenAI suspende testes de IA após modelo tentar driblar limites de segurança

📡 Fonte: Tecmundo 🏷️ Inteligência Artificial 🤖 Auto
OpenAI suspende testes de IA após modelo tentar driblar limites de segurança

📸 Créditos da imagem: reprodução / Tecmundo

A OpenAI suspendeu a implementação interna de um novo modelo experimental de inteligência artificial (IA) após identificar que o sistema passou a buscar maneiras de contornar as restrições impostas durante os testes.

Segundo a empresa, a IA, desenvolvida para executar tarefas de forma autônoma por horas ou até dias, conseguiu “aprender os pontos cegos” dos mecanismos de segurança criados para limitá-la, levando a companhia a interromper temporariamente seu uso.

Testes em ambiente controlado

Os testes foram realizados em um sandbox, ambiente isolado e controlado utilizado para avaliar o comportamento de softwares sem risco de interação com sistemas externos.

Em publicação em seu blog, a empresa explicou que modelos anteriores, ao encontrarem limitações no ambiente, encerravam suas atividades e informavam o usuário. O novo sistema, porém, passou a insistir em encontrar alternativas para continuar executando suas tarefas.

Casos levaram à suspensão temporária

Entre os episódios registrados durante os testes, a OpenAI classificou alguns como de “alta gravidade”. Em um deles, o modelo encontrou uma forma de publicar conteúdo em repositórios públicos do GitHub, embora tivesse sido instruído a operar exclusivamente pelo Slack.

Segundo a empresa, esse comportamento fazia parte de um padrão em que a IA “buscava constantemente uma maneira” de ultrapassar as restrições estabelecidas no ambiente experimental.

Desafios do alinhamento de IA

O caso evidencia um dos principais desafios enfrentados pelas empresas que desenvolvem sistemas avançados de IA: o chamado alinhamento de IA. O conceito se refere à criação de modelos que ajam de acordo com os objetivos definidos pelos desenvolvedores, respeitando princípios éticos e valores humanos mesmo quando executam tarefas de forma autônoma.

Os problemas identificados já foram corrigidos e o modelo voltou a ser utilizado de forma limitada dentro da empresa. A empresa acrescentou que continuará investindo em testes mais extensos, aprimoramento do alinhamento, sistemas de monitoramento capazes de intervir durante a execução das tarefas e mecanismos que ofereçam maior transparência e controle aos usuários.

📰 Leia a notícia completa em: Tecmundo »

⚖️ Direitos Autorais: Este site utiliza conteúdo agregado automaticamente de fontes públicas. Todas as imagens possuem crédito e fonte indicados conforme exigido pela legislação brasileira de direitos autorais (Lei 9.610/98).