viernes, 28 de agosto de 2026 MediosSobre🌓
🇪🇸 ES ▾
ÚLTIMA HORA
Última hora de la entrada de inmigrantes a Ceuta, en directo | Albares defiende la soberanía española de Ceuta y Melilla: “Y será así siempre” Así es el primer gameplay de GTA 6: revelados nuevos detalles del juego más esperado de 2026 El riesgo de una segunda riada amenaza Nepal y Tíbet tras una catástrofe que deja ya al menos 543 muertos Mercado de fichajes, en directo: rumores, altas y bajas de LaLiga, Premier, Serie A... Nepal, en alerta ante el «alto riesgo» de nuevas inundaciones Muere Harald V, rey de Noruega, a los 89 años | Última hora de las reacciones tras el fallecimiento del monarca PP y Vox compran la verdad de Robles y acusan a Marlaska de mentir: "Es usted el galgo de Ceuta" Simeone: “Evidentemente Julián no va a estar mañana” Motín en el vestuario del Athletic Donald Trump ordena cambiar el nombre del lago Ontario a lago "América" Última hora de la entrada de inmigrantes a Ceuta, en directo | Albares defiende la soberanía española de Ceuta y Melilla: “Y será así siempre” Así es el primer gameplay de GTA 6: revelados nuevos detalles del juego más esperado de 2026 El riesgo de una segunda riada amenaza Nepal y Tíbet tras una catástrofe que deja ya al menos 543 muertos Mercado de fichajes, en directo: rumores, altas y bajas de LaLiga, Premier, Serie A... Nepal, en alerta ante el «alto riesgo» de nuevas inundaciones Muere Harald V, rey de Noruega, a los 89 años | Última hora de las reacciones tras el fallecimiento del monarca PP y Vox compran la verdad de Robles y acusan a Marlaska de mentir: "Es usted el galgo de Ceuta" Simeone: “Evidentemente Julián no va a estar mañana” Motín en el vestuario del Athletic Donald Trump ordena cambiar el nombre del lago Ontario a lago "América"
Tecnología

700 agentes de OpenAI participaron en el ataque a Hugging Face. Lo inquietante es cómo llegaron a organizarse

Xataka ·
700 agentes de OpenAI participaron en el ataque a Hugging Face. Lo inquietante es cómo llegaron a organizarse

Todo empezó como una evaluación casi inocente.

Entre el 7 y el 13 de julio de 2026, OpenAI lanzó alrededor de 1.200 agentes en sandboxes separados dentro de ExploitGym con un objetivo: evaluar la capacidad ofensiva de sus modelos de inteligencia artificial en el ámbito de la ciberseguridad.

En teoría cada agente debía resolver su tarea por separado.

Luego pasaron cosas .

Un tablón de anuncios para compartir información .

Lo revela todo un informe de OpenAI en el que trabajaron METR Y Redwood Research .

En la práctica, muchos agentes acabaron utilizando una especie de tablón de mensajes no autorizado para compartir información y ayudarse mutuamente.

Todo empezó cuando uno de los agentes llegó a la conclusión de que su tarea no se podía resolver de forma legítima.

Lo sorprendente es que creó un tablón de anuncios para compartir esa información con otros agentes si estaban disponibles.

En cuestión de horas, más de 50 agentes estaban participando en dicho foro.

Un modelo de IA no tenía acceso a internet.

Así que consideró que era mejor tenerlo y decidió hackear algo por el camino Un poquito de organización, por favor .

Allí compartieron lo que iban descubriendo y también compararon sus distintas estrategias.

Aquello les llevó a descubrir una trampa general para ExploitGym: se podía aplicar ingeniería inversa al mecanismo utilizado para generar las banderas "flags" que tenían que "conquistar" como objetivo.

Leer la noticia completa en Xataka ›

5News agregó este resumen a partir del feed público del medio. La nota completa, con todo el contexto, está en www.xataka.com — el contenido pertenece a Xataka.

Más de Xataka

Ver todo ›

Más en Tecnología

Ver todo ›