📸 Créditos da imagem: reprodução / Tecmundo
A OpenAI suspendeu a implementação interna de um novo modelo experimental de inteligência artificial (IA) após identificar que o sistema passou a buscar maneiras de contornar as restrições impostas durante os testes.
Segundo a empresa, a IA, desenvolvida para executar tarefas de forma autônoma por horas ou até dias, conseguiu “aprender os pontos cegos” dos mecanismos de segurança criados para limitá-la, levando a companhia a interromper temporariamente seu uso.
Testes em ambiente controlado
Os testes foram realizados em um sandbox, ambiente isolado e controlado utilizado para avaliar o comportamento de softwares sem risco de interação com sistemas externos.
Em publicação em seu blog, a empresa explicou que modelos anteriores, ao encontrarem limitações no ambiente, encerravam suas atividades e informavam o usuário. O novo sistema, porém, passou a insistir em encontrar alternativas para continuar executando suas tarefas.
Casos levaram à suspensão temporária
Entre os episódios registrados durante os testes, a OpenAI classificou alguns como de “alta gravidade”. Em um deles, o modelo encontrou uma forma de publicar conteúdo em repositórios públicos do GitHub, embora tivesse sido instruído a operar exclusivamente pelo Slack.
Segundo a empresa, esse comportamento fazia parte de um padrão em que a IA “buscava constantemente uma maneira” de ultrapassar as restrições estabelecidas no ambiente experimental.
Desafios do alinhamento de IA
O caso evidencia um dos principais desafios enfrentados pelas empresas que desenvolvem sistemas avançados de IA: o chamado alinhamento de IA. O conceito se refere à criação de modelos que ajam de acordo com os objetivos definidos pelos desenvolvedores, respeitando princípios éticos e valores humanos mesmo quando executam tarefas de forma autônoma.
Os problemas identificados já foram corrigidos e o modelo voltou a ser utilizado de forma limitada dentro da empresa. A empresa acrescentou que continuará investindo em testes mais extensos, aprimoramento do alinhamento, sistemas de monitoramento capazes de intervir durante a execução das tarefas e mecanismos que ofereçam maior transparência e controle aos usuários.
📰 Leia a notícia completa em: Tecmundo »