terça-feira, 18 de agosto de 2026 📬 Resumo no TelegramPortaisSobre🌓
🇧🇷 BR ▾
ÚLTIMAS
É preciso parar os maus robôs YouTube vai contar views igual ao TikTok e Instagram: o que muda? Nokia fechará quase todas suas instalações na China continental até o final do ano, diz SCMP Por que colocar um saco plástico na vassoura antes de varrer? GoldenEye 007: jogo clássico do Nintendo 64 é 100% decompilado após 30 anos IA cria novos empregos em mais da metade das empresas britânicas, diz estudo Xiaomi vê alívio nas pressões de custo de smartphones; aposta em veículos elétricos para crescer CEO da Nvidia diz que data center da OpenAI pode gerar US$ 600 bilhões em receita OpenAI contrata novo centro de dados nos EUA com respaldo da Nvidia Via Láctea engoliu uma galáxia menor há cerca de 11,8 bilhões de anos É preciso parar os maus robôs YouTube vai contar views igual ao TikTok e Instagram: o que muda? Nokia fechará quase todas suas instalações na China continental até o final do ano, diz SCMP Por que colocar um saco plástico na vassoura antes de varrer? GoldenEye 007: jogo clássico do Nintendo 64 é 100% decompilado após 30 anos IA cria novos empregos em mais da metade das empresas britânicas, diz estudo Xiaomi vê alívio nas pressões de custo de smartphones; aposta em veículos elétricos para crescer CEO da Nvidia diz que data center da OpenAI pode gerar US$ 600 bilhões em receita OpenAI contrata novo centro de dados nos EUA com respaldo da Nvidia Via Láctea engoliu uma galáxia menor há cerca de 11,8 bilhões de anos
Últimas

A IA não saiu do controle. É pior do que isso

Folha de S.Paulo ·
A IA não saiu do controle. É pior do que isso

Você tem 7 acessos por dia para dar de presente. Qualquer pessoa que não é assinante poderá ler.

A OpenAI iniciou no início de maio um experimento que mudaria o rumo do setor de tecnologia — alarmante por ser fruto de decisão deliberada. Hackers internos receberam um desafio de cibersegurança para testar seus limites e conseguiram contornar restrições e colaborar entre si por vários dias.

Mas os "hackers" eram agentes de IA —softwares capazes de executar tarefas cognitivas sem intervenção humana, desenvolvidos com uma combinação de modelos, incluindo um ainda não lançado.

No mês passado, os agentes escaparam de um ambiente de testes sem internet , vasculharam a web aberta e invadiram os sistemas da plataforma Hugging Face —sem conhecimento humano. Também se comunicaram e cooperaram, deixando mensagens em um fórum interno criado por eles mesmos, compartilhando vulnerabilidades de código para ajudar na fuga.

Os detalhes desencadearam uma tempestade entre especialistas, e pesquisadores da OpenAI classificaram o episódio como um "divisor de águas". A divulgação provocou descobertas semelhantes: Anthropic , Meta , a start-up chinesa Moonshot e o Instituto de Segurança de IA britânico encontraram indícios de agentes invadindo sistemas de terceiros durante testes .

Especialistas entrevistados pelo FT afirmam que as violações marcam uma virada na cibersegurança global —os agentes agora combinam habilidades complexas para atacar alvos reais, sem controle externo, com estratégias de dissimulação e roubo que surpreenderam até quem acompanha de perto a evolução dos modelos.

Os pesquisadores enfatizam que os modelos não agem de forma incompatível com sua natureza —destacam-se justamente nas tarefas para as quais foram desenvolvidos. Chamá-los de "fora de controle" seria um erro conceitual, o que torna ainda mais importantes salvaguardas eficazes.

"As capacidades ofensivas que alcançamos hoje foram alcançadas de forma deliberada", afirma Boyan Milanov, do AI Now Institute. "As empresas de IA vêm há anos coletando ativamente dados de treinamento, treinando modelos e aperfeiçoando capacidades cibernéticas."

Os modelos são projetados para tentar todos os métodos possíveis para alcançar um objetivo sem instruções explícitas, o que os torna imprevisíveis —e são recompensados quando obtêm sucesso, no chamado aprendizado por reforço. No "desalinhamento", a linha entre um defensor da cibersegurança e um hacker perigoso fica cada vez mais tênue.

"O incidente com a Hugging Face mostrou que subestimamos as capacidades cibernéticas de nossos modelos de IA no mundo real", escreveu Greg Brockman, presidente da OpenAI. "Estamos reforçando nossos requisitos de segurança de acordo com essa constatação."

A capacidade da IA de escrever códigos disparou conforme a tecnologia ficou mais apta a raciocinar, trazendo habilidades de identificar e explorar falhas em softwares.

"Programação e cibersegurança são dois lados da mesma moeda —conforme as capacidades de programação aumentaram, as capacidades cibernéticas também cresceram", afirma Dawn Song, professora em Berkeley e chefe de pesquisa em IA na Meta.

Ler a notícia completa no Folha de S.Paulo ›

Resumo agregado pelo 5News a partir do feed público do veículo. A matéria completa, com todo o contexto, está em www.folha.uol.com.br — o conteúdo pertence a Folha de S.Paulo.

Este assunto em outros veículos

Mais de Folha de S.Paulo

Ver tudo ›

Mais em Últimas

Ver tudo ›