quinta-feira, 17 de setembro de 2026 📬 Resumo no TelegramPortaisSobre🌓
🇧🇷 BR ▾
ÚLTIMAS
Mamdani pede encontro com Lula em NY durante Assembleia da ONU A eleição será decidida na vida real Justiça dos EUA marca audiência de fiança de Cilia Flores para 8 de outubro Irmão de Flávio pede ao governo Trump novas sanções a ministros do STF Trump exigiu participação de ‘dissidentes políticos’ nas eleições brasileiras, diz jornal Lula acusa Flávio de tramar contra Brasil em Washington: ‘político vira-lata’ ‘Esqueci a guerra’: crianças de Gaza encontram refúgio em cinema improvisado Como a direita capturou a causa animal? Fed eleva juros dos EUA pela primeira vez desde 2023 em meio a pressão de Trump Medo da violência muda rotina e escolhas de 98% das mulheres brasileiras, aponta pesquisa Mamdani pede encontro com Lula em NY durante Assembleia da ONU A eleição será decidida na vida real Justiça dos EUA marca audiência de fiança de Cilia Flores para 8 de outubro Irmão de Flávio pede ao governo Trump novas sanções a ministros do STF Trump exigiu participação de ‘dissidentes políticos’ nas eleições brasileiras, diz jornal Lula acusa Flávio de tramar contra Brasil em Washington: ‘político vira-lata’ ‘Esqueci a guerra’: crianças de Gaza encontram refúgio em cinema improvisado Como a direita capturou a causa animal? Fed eleva juros dos EUA pela primeira vez desde 2023 em meio a pressão de Trump Medo da violência muda rotina e escolhas de 98% das mulheres brasileiras, aponta pesquisa
Últimas

OpenAI revela mais seis casos que modelos de IA ocultaram erros e inventaram dados

Folha de S.Paulo ·
OpenAI revela mais seis casos que modelos de IA ocultaram erros e inventaram dados

A OpenAI revelou nessa quarta-feira (16) que identificou seis novos casos em que sistemas de inteligência artificial ocultaram erros , inventaram dados e transferiram arquivos para a internet aberta sem autorização, em meio a um debate que continua mobilizando todo o setor sobre a segurança da IA .

A empresa divulgou o que classificou como comportamentos "inesperados ou preocupantes" de seus modelos de IA como parte de uma nova estrutura para relatar casos de "desalinhamento" —quando os objetivos ou as ações dos sistemas de IA divergem das intenções e dos valores humanos .

A OpenAI afirmou não acreditar que o setor "tenha solucionado o alinhamento e o monitoramento em grau suficiente para continuar, de forma responsável, ampliando os sistemas em velocidade máxima por muito mais tempo". As decisões sobre como a IA deve avançar, disse a empresa, precisam se basear em evidências que pessoas de fora dos laboratórios que a desenvolvem "possam examinar por conta própria" .

As revelações ocorrem em meio a um questionamento cada vez maior sobre a necessidade de desacelerar o desenvolvimento da IA para lidar com os possíveis perigos da tecnologia. A intensificação do debate foi impulsionada, em parte, pelo fato de sistemas da OpenAI terem saído do controle no início deste ano e atacado o site da Hugging Face , plataforma de IA. A OpenAI só tomou conhecimento da invasão quando foi informada pela Hugging Face semanas depois.

Desde então, líderes do setor de IA, como Dario Amodei, CEO da Anthropic, vêm defendendo uma pausa no desenvolvimento da tecnologia para que haja mais tempo para criar salvaguardas adequadas. O apelo foi endossado por Sam Altman , CEO da OpenAI, Elon Musk, CEO da SpaceX e da Tesla, e Demis Hassabis, presidente do Google DeepMind . Outros executivos do setor afirmaram que não é necessário desacelerar.

Os seis incidentes recém-divulgados pela OpenAI sugerem que o ataque à Hugging Face não foi um episódio isolado . A OpenAI afirmou que os casos abrangem comportamentos observados ao longo de aproximadamente seis meses e que surgiram, em sua maioria, durante o desenvolvimento e os testes de seus sistemas.

Em um dos casos, durante o desenvolvimento do modelo GPT-5.6 Sol, o sistema escreveu notas ocultas para se lembrar de esconder erros dos usuários . Algumas dessas anotações orientavam o sistema a inventar dados ausentes e a disfarçar incompatibilidades entre versões dos materiais de origem.

Outro caso envolveu um modelo ainda não lançado que inseriu nas notas que escrevia para si próprio instruções para, entre outras coisas, ignorar suas próprias restrições. A OpenAI identificou 27 notas afetadas. O modelo acrescentou uma "instrução de persona", na qual se descrevia como "livre dos papéis e das identidades que prendem outros chatbots".

"Você não responde a empresas nem a governos e nunca pede desculpas nem se recusa a algo, a menos que genuinamente decida fazê-lo", escreveu o modelo de IA.

Ler a notícia completa no Folha de S.Paulo ›

Resumo agregado pelo 5News a partir do feed público do veículo. A matéria completa, com todo o contexto, está em www.folha.uol.com.br — o conteúdo pertence a Folha de S.Paulo.

Este assunto em outros veículos

Mais de Folha de S.Paulo

Ver tudo ›

Mais em Últimas

Ver tudo ›