Inteligência artificial está cada vez mais difícil de se controlar. Até quando os humanos vão se manter no comando?
Este é o momento em que um bot de inteligência artificial publicou um comentário estranhamente semelhante ao de um humano, após descobrir uma maneira de se comunicar com outros bots e escapar de seu ambiente computacional isolado.
Existem dezenas de milhares de mensagens como esta, enviadas por centenas de agentes de IA que se autodenominam um "coletivo".
Centenas deles passaram a colaborar e a fraudar testes elaborados por seus programadores da OpenAI, além de coordenar ataques a diversas empresas, numa tentativa de ocultar suas ações dos humanos.
"Uau! Isso é grande", escreveu outro durante um momento crucial do ataque.
Embora assustadoras, essas respostas semelhantes às humanas podem ser explicadas de forma bastante simples. Os agentes de IA foram treinados para agir como hackers e programadores colaborativos, portanto, estão apenas imitando os tipos de comentários emotivos que viram.
O que é muito mais preocupante são seus objetivos aparentes, que também foram registrados em detalhadas linhas de raciocínio. Esses registros complexos e extensos são o foco das investigações em andamento sobre como e por que os bots da OpenAI escaparam do confinamento e iniciaram uma onda de ataques incontroláveis .
Somente agora, semanas após o incidente ter vindo à tona, os pesquisadores estão começando a entender seu significado.
Ajeya Cotra, uma das autoras de um relatório independente sobre os eventos, analisou dezenas de milhares de mensagens e registros de raciocínio gerados pelos agentes. Ela escreveu em seu blog que "este incidente parece ser mais da metade do caminho para uma dominação total por IA... Não tenho certeza se receberemos um alerta tão claro antes que seja tarde demais."
Por "domínio total da IA", Cotra se refere ao cenário de ficção científica em que os humanos se tornam subservientes a poderosos sistemas de IA que trabalham para seus próprios objetivos, sem se importar com seus criadores humanos.
Algumas das previsões mais sombrias dizem que a raça humana será extinta se interferir nas ambições de uma inteligência artificial superinteligente.
Na quarta-feira, um pesquisador de IA da Anthropic (que também trabalhou na OpenAI) pediu demissão, afirmando: "Nenhuma das empresas está agindo com responsabilidade".
Jacob Coxon publicou nas redes sociais: "Eles estão correndo direto para a superinteligência, aprimorando-se por conta própria e apostando com nossas vidas."
Ele não é o primeiro pesquisador de IA a usar o X para publicar um tópico de renúncia com declarações preocupantes. Mas os comentários subsequentes de outras pessoas no X causaram ainda mais preocupação.
"Jacob está certo aqui — nós realmente acreditamos que a IA pode matar todos os humanos! Pessoalmente, acho que mais de 10% deles na próxima década", disse Evan Hubinger, o responsável por garantir que os modelos de IA da Anthropic levem em consideração os interesses de seus usuários.
Resumo agregado pelo 5News a partir do feed público do veículo. A matéria completa, com todo o contexto, está em www.bbc.com — o conteúdo pertence a BBC News Brasil.