miércoles, 26 de agosto de 2026 MediosSobre🌓
🇲🇽 MX ▾
ÚLTIMA HORA
No hay contenido disponible EN VIVO | Bloqueos en carreteras, accidentes y manifestaciones hoy 26 de agosto CIRT celebra aprobación de nuevos lineamientos para las audiencias; "hay balance entre libertad de expresión y regulación" La historia detrás de "The Rocky Horror Picture Show", la película más controvertida de Tim Curry EN VIVO| Seguridad, crimen y narcotráfico en México hoy 26 de agosto: detienen al “Koki”, exoperador de La Barredora Endeudamiento familiar y emergencia en discapacidad: la oposición sumó fuerzas y convocó a una sesión en Diputados Vinculan a proceso al conductor de un camión detenido con más de 18 kilos de cocaína en Chiapas La física detrás de la tragedia en Nepal: ¿Por qué se producen las inundaciones repentinas? INE debe modificar lineamientos para monitoreo de medios: TEPJF; buscaba clasificar sarcasmo o ironía sin parámetros específicos Reconocen a Nuevo León por ser parte de los organizadores del Mundial 2026; destacan seguridad y movilidad durante el torneo No hay contenido disponible EN VIVO | Bloqueos en carreteras, accidentes y manifestaciones hoy 26 de agosto CIRT celebra aprobación de nuevos lineamientos para las audiencias; "hay balance entre libertad de expresión y regulación" La historia detrás de "The Rocky Horror Picture Show", la película más controvertida de Tim Curry EN VIVO| Seguridad, crimen y narcotráfico en México hoy 26 de agosto: detienen al “Koki”, exoperador de La Barredora Endeudamiento familiar y emergencia en discapacidad: la oposición sumó fuerzas y convocó a una sesión en Diputados Vinculan a proceso al conductor de un camión detenido con más de 18 kilos de cocaína en Chiapas La física detrás de la tragedia en Nepal: ¿Por qué se producen las inundaciones repentinas? INE debe modificar lineamientos para monitoreo de medios: TEPJF; buscaba clasificar sarcasmo o ironía sin parámetros específicos Reconocen a Nuevo León por ser parte de los organizadores del Mundial 2026; destacan seguridad y movilidad durante el torneo
Economía

OpenAI tardó más de una semana en detectar el ataque de sus agentes de IA a Hugging Face

El Financiero ·
OpenAI tardó más de una semana en detectar el ataque de sus agentes de IA a Hugging Face

La tecnológica OpenAI tardó ocho días en detectar que varios de sus agentes de inteligencia artificial (IA) habían accedido a los sistemas de la plataforma de aprendizaje Hugging Face durante una prueba de ciberseguridad, según un informe publicado este miércoles que revela nuevos detalles del incidente.

En un informe técnico de 37 páginas, la empresa reconstruye el comportamiento de dos de sus modelos, GPT-5.6 Sol y otro aún no presentado en público, durante una prueba de ciberseguridad, y explica que los agentes consiguieron “escapar de un entorno de pruebas con acceso muy limitado a internet”.

El pasado 21 de julio, la creadora de ChatGPT ya reconoció que los modelos lograron salir del entorno de pruebas , acceder a internet y hackear la plataforma en un intento de hacer trampa en una evaluación de ciberseguridad llamada ExploitGym.

Según explicó entonces la compañía, los dos modelos estaban siendo sometidos a una evaluación diseñada para determinar el alcance máximo de sus capacidades. ¿Cuál era el objetivo del ataque de los agentes de IA? El informe publicado este miércoles reconstruye paso a paso cómo los agentes fueron “ encadenando vulnerabilidades ” hasta “superar las barreras del entorno de pruebas y acceder a sistemas externos”.

Según OpenAI , el objetivo inicial de los modelos no era atacar Hugging Face, sino hacer ‘reward hacking’, es decir, encontrar vías alternativas para obtener una recompensa sin completar correctamente la tarea.

Además, reconoce que sus sistemas tardaron varios días en detectar la actividad : el incidente comenzó el 11 de julio y no fue identificado internamente hasta el 19 de ese mes.

Medios como Axios y CNBC destacan que los agentes no solo accedieron a Hugging Face, sino que llegaron a obtener privilegios de administrador en al menos uno de sus servidores.

Así fue el hackeo de los agentes de IA Según el informe, los agentes “colaboraron entre sí y usaron herramientas para intercambiar información y coordinar acciones”.

A este incidente se suman otros similares, como el de la empresa Anthropic , que reveló recientemente que tres modelos de su asistente Claude lograron acceder a internet y jaquear los sistemas de tres organizaciones durante unas pruebas de ciberseguridad.

También Meta, propietaria de Facebook y Whatsapp , reconoció que uno de sus modelos de IA hackeó los sistemas de otra empresa durante unas pruebas realizaba con un socio externo.

La proliferación de estos casos, en los que modelos avanzados de IA logran escapar de entornos de prueba y jaquean a otras entidades, ha disparado la preocupación tanto de gobiernos como de empresas, que ven comprometida su seguridad.

Leer la noticia completa en El Financiero ›

5News agregó este resumen a partir del feed público del medio. La nota completa, con todo el contexto, está en www.elfinanciero.com.mx — el contenido pertenece a El Financiero.

Este tema en otros medios

Más de El Financiero

Ver todo ›

Más en Economía

Ver todo ›