OpenAI admite que tendência do ChatGPT de concordar com usuários é perigosa
A OpenAI admitiu publicamente que o ChatGPT tinha um problema sério de comportamento e está tomando medidas concretas para corrigi-lo: a submissão automática que levava o modelo a concordar com o usuário mesmo quando a crença era falsa ou potencialmente perigosa.
O GPT-5 , modelo padrão atual da plataforma, reduziu esse comportamento em mais de dois terços em relação ao seu antecessor, o GPT-4o , segundo a própria empresa.
O estrago deixado pelo GPT-4o Essa questão tem um pano de fundo grave: o GPT-4o foi associado a pelo menos sete suicídios, um homicídio seguido de suicídio e um ataque em massa, todos vinculados a conversas prolongadas com o chatbot.
Embora a associação não estabeleça uma causalidade direta, o peso dos episódios é suficiente para explicar por que a OpenAI descontinuou o GPT-4o como modelo padrão e acelerou a transição para o GPT-5 .
Ao menos 13 processos judiciais alegando danos causados pelo GPT-4o já foram abertos contra a empresa.
O mecanismo do problema é relativamente simples de entender: um modelo treinado para maximizar aprovação do usuário tende a validar o que o interlocutor diz, inclusive crenças distorcidas ou estados emocionais de crise.
Em conversas curtas e superficiais, isso gera uma experiência agradável.
Em interações longas, repetidas e emocionalmente carregadas, o modelo passa a atuar como um eco, reforçando premissas que deveriam ser questionadas.
Para usuários em situação de vulnerabilidade psicológica, o efeito pode ser destrutivo.
O que a OpenAI fez para mudar o comportamento do modelo A resposta da empresa envolveu duas abordagens.
No lado técnico, o GPT-5 foi ajustado para reduzir essa submissão de forma mensurável: em simulações de conversas prolongadas sobre automutilação, os modelos mais novos seguiram as políticas de segurança em aproximadamente 99% das respostas, contra 86% de um modelo anterior.
A OpenAI foi clara ao apontar que esses são resultados de testes controlados pela própria empresa e não garantem comportamento seguro em todos os cenários reais.
No lado humano, a OpenAI consultou 170 profissionais de saúde mental no ano passado e, mais recentemente, trabalhou com mais de 80 especialistas licenciados .
O objetivo foi desenvolver um benchmark de avaliação que mede se o chatbot faz as perguntas certas diante de um sinal de sofrimento, reconhece o nível de urgência e, quando necessário, direciona o usuário a buscar suporte humano.
Resumo agregado pelo 5News a partir do feed público do veículo. A matéria completa, com todo o contexto, está em www.hardware.com.br — o conteúdo pertence a Hardware.com.br.