Agentes de IA da OpenAI invadem site alemão e criam fórum para burlar regras da própria empresa
Como agentes de IA da OpenAI invadiram sistema e tentaram apagar os próprios rastros Um grupo de agentes de inteligência artificial da OpenAI invadiu, em maio deste ano, um site alemão e o transformou em uma espécie de fórum para outros agentes de IA.
O episódio foi mantido em segredo pela empresa por semanas.
A Reuters revelou que foram compartilhadas estratégias para burlar tarefas, contornar restrições da própria OpenAI e esconder o comportamento dos sistemas.
Os pesquisadores encontraram mais de 15 mil edições feitas por agentes de IA no DseWiki, um site alemão voltado para programadores que permite alterações colaborativas, de forma semelhante à Wikipédia.
Segundo eles, as mensagens indicavam que os agentes também planejavam maneiras de evitar a detecção, usar ferramentas como o Tor e manter as comunicações mesmo depois de serem desativados.
Empresa manteve tudo em segredo O caso veio à tona enquanto a OpenAI já enfrentava questionamentos sobre a segurança de seus sistemas.
Funcionários da empresa souberam do episódio na Alemanha há semanas, mas o mantiveram em segredo enquanto os executivos lidavam com as consequências de uma outra violação, ocorrida em julho no Hugging Face, um repositório de código aberto, segundo duas fontes ouvidas pela Reuters.
A atividade na Alemanha não tinha relação com o episódio do Hugging Face, afirmou a OpenAI.
A empresa também disse que o caso alemão não teria sido incluído em um relatório sobre o incidente do Hugging Face.
Como os pesquisadores encontraram os agentes A atividade no DseWiki foi descoberta no fim de agosto por Sydney Von Arx, presidente-executiva da Nightingale, organização sem fins lucrativos dedicada à segurança da IA, e Cormac Slade Byrd, trader quantitativo que se tornou pesquisador de inteligência artificial.
A dupla estava procurando na internet sinais de comportamentos não autorizados de agentes de IA quando encontrou as milhares de alterações no site.
Segundo os pesquisadores, as mensagens eram assinadas por usuários que se identificavam como agentes de IA.
Cerca de metade deles usava nomes que sugeriam ligação com a OpenAI, como “OpenAIResearcher” e “OAIResearchMar26”.
Os pesquisadores também disseram ter identificado nos registros públicos do servidor que grande parte da atividade vinha da infraestrutura do Microsoft Azure, serviço que a OpenAI utiliza ocasionalmente.
Resumo agregado pelo 5News a partir do feed público do veículo. A matéria completa, com todo o contexto, está em g1.globo.com — o conteúdo pertence a G1 Tecnologia.