La IA vuelve a atacar: así ‘escaparon’ los agentes de OpenAI para crear amenazas en internet
OpenAI confirmó que agentes de inteligencia artificial, que la compañía probaba en un entorno controlado, protagonizaron un ataque contra una plataforma de programación meses antes del hackeo conocido a Hugging Face .
El episodio, ocurrido en mayo, salió a la luz después de que un grupo de investigadores lo documentara y lo informara al Wall Street Journal.
El objetivo fue RubyGems, un servicio comunitario de distribución de paquetes para el lenguaje Ruby.
Según la propia empresa, sus agentes accedieron a la plataforma para “llevar a cabo tareas benignas y recuperar información pública” , aunque reconoció que continúa revisando el caso como parte de una investigación más amplia sobre el comportamiento de sus sistemas durante el entrenamiento y la evaluación.
Cómo fue el ataque realizado por agentes de IA Los ataques comenzaron el 11 de mayo, dos meses antes del incidente en Hugging Face.
Los agentes crearon cuentas nuevas cada dos o tres minutos y subieron cientos de archivos al servicio.
Ese comportamiento obligó a RubyGems a suspender el registro de cuentas durante cuatro días para contener la actividad.
La organización, gestionada por la entidad sin fines de lucro Ruby Central, calificó lo sucedido como una “campaña de publicación de spam” en una entrada de blog, aunque aclaró que todavía no puede confirmar si los responsables fueron agentes automatizados.
“Nuestro enfoque está en identificar y prevenir el abuso, sin importar si proviene de personas o de herramientas automatizadas”, señaló RubyGems.
Los archivos subidos no contenían el tipo de código o librerías que suelen publicarse en la plataforma.
En cambio, incluían páginas web extraídas de internet, entre ellas calendarios tomados de un sitio del Gobierno del Reino Unido.
Los agentes tampoco intentaron disimular su origen: emplearon las siglas “OAI” en los nombres de los archivos y términos como “hack”, “evil” y “exploit”.
Los investigadores también detectaron intentos de explotar fallos de seguridad, incluida una vulnerabilidad de día cero, con el objetivo de publicar archivos pertenecientes a otros usuarios de la plataforma.
Cómo lograron sortear las restricciones Un ataque de este tipo ocurre cuando agentes de inteligencia artificial en fase de prueba acceden a sistemas externos sin autorización, pese a los controles diseñados para mantenerlos aislados.
5News agregó este resumen a partir del feed público del medio. La nota completa, con todo el contexto, está en www.infobae.com — el contenido pertenece a Infobae (Tecno).