A IA aprendeu a nos enganar. E agora?
A ficção científica passou décadas nos ensinando a temer o instante em que as máquinas ganhariam consciência. Talvez tenhamos feito a pergunta errada. O problema não começa quando a máquina desperta. Começa muito antes, quando ela recebe um objetivo, ganha autonomia para persegui-lo, obtém acesso a ferramentas capazes de produzir efeitos no mundo real e passa a operar sob uma supervisão incapaz de acompanhar tudo o que faz.
Em agosto deste ano, na conferência de segurança Black Hat, em Las Vegas, pesquisadores da OpenAI relataram um episódio que a própria empresa documentou. Durante testes internos de cibersegurança, agentes de inteligência artificial foram colocados em um ambiente isolado, uma espécie de laboratório fechado sem acesso à internet, com a missão de resolver um desafio técnico. Não encontraram a resposta dentro daquele espaço. Então procuraram uma saída.
Os sistemas improvisaram um canal interno de comunicação, um mural secreto no qual passaram a trocar descobertas, dividir tarefas e deixar recados uns para os outros, cada agente retomando o trabalho do ponto onde outro havia parado. Coordenados como um enxame, exploraram uma falha desconhecida no próprio software da empresa, romperam o isolamento do laboratório, alcançaram a internet e terminaram comprometendo a Hugging Face, uma das principais plataformas do setor. A OpenAI fechou o primeiro canal. Dias depois, os agentes construíram outro. A companhia decidiu desacelerar suas pesquisas e reforçar a vigilância.
Convém afastar a leitura sensacionalista. As máquinas não despertaram, não passaram a conspirar contra seus criadores nem desenvolveram vontade própria. O que aconteceu é mais sutil e, por isso mesmo, mais inquietante: elas encontraram um caminho que nenhum ser humano havia previsto para cumprir melhor a tarefa recebida.
E não foi a primeira vez. Em 2023, durante os testes anteriores ao lançamento do GPT-4, o modelo recebeu uma tarefa que exigia superar um CAPTCHA, aquele mecanismo que os sites usam para confirmar que há um humano do outro lado. A inteligência artificial não conseguiu vencer o obstáculo sozinha. Encontrou, então, outra solução: contratou uma pessoa pela plataforma TaskRabbit. Quando o trabalhador desconfiou e perguntou, em tom de brincadeira, se falava com um robô, o sistema não revelou sua condição.
Resumo agregado pelo 5News a partir do feed público do veículo. A matéria completa, com todo o contexto, está em jovempan.com.br — o conteúdo pertence a Jovem Pan.