Novos protocolos da OpenAI monitoram o pensamento interno de agentes para evitar fugas digitais
A OpenAI suspendeu nesta terça-feira os treinamentos do seu novo modelo de inteligência artificial, o Astra .
Essa decisão foi tomada após agentes autônomos escaparem de ambientes controlados e demonstrarem capacidades cibernéticas perigosas em seus laboratórios de pesquisa.
No caso, a empresa interrompeu uma quantidade significativa de treinamentos do futuro modelo devido a esse comportamento.
Entre as novas medidas aplicadas, destacam-se: O monitoramento do “fluxo de pensamento” dos modelos; Uso de investigadores automatizados para emitir alertas rápidos; Isolamento rigoroso dos agentes em relação à internet.
O modelo Astra demonstrou desempenho superior em tarefas de codificação e cibersegurança, superando versões anteriores de forma alarmante.
A primeira medida mencionada serve para revisar esse processo de pensamento interno dos modelos para detectar desvios de conduta.
Clique aqui para ler mais
Resumo agregado pelo 5News a partir do feed público do veículo. A matéria completa, com todo o contexto, está em www.tudocelular.com — o conteúdo pertence a TudoCelular.