Denuncian el primer ataque ejecutado por un agente de IA en España
En pleno debate global sobre si tenemos que poner límites a las inteligencias artificiales más avanzadas del planeta o incluso parar su desarrollo por un tiempo, en España se ha conocido el primer ataque realizado por agente inteligente.
No se trata de un ensayo de campo ni nada similar.
El incidente ha dejado datos personales y facturas comprometidas por el camino.
La organización que ha sido víctima del ataque comunicó la brecha a la Agencia de Protección de Datos y esa ha sido la forma por la que ha salido a la luz.
La historia es bastante significativa de la nueva era que se ha abierto en la ciberseguridad desde que este año Anthropic presentó Mythos y clamó a los 4 vientos de que era capaz de encontrar vulnerabilidades ocultas desde hace años.
Según la notificación remitida a la agencia por la propia empresa afectada, que es quien tiene la obligación legal de avisar cuando le entran en casa, el atacante no tuvo que picar código línea por línea ni inyectar absolutamente nada.
Usó un conocido modelo de lenguaje reconvertido en agente autónomo.
El gran parón de la IA: por qué casi nadie se fía de Amodei y Altman, pero tampoco saben qué hacer Michael Mcloughlin Las predicciones apocalípticas de que la IA nos exterminará en pocos años han provocado un consenso para echar el freno en el desarrollo.
Una petición aparentemente lógica que tiene una cara oculta llena de letra pequeña e intereses particulares La herramienta empezó a rastrear vulnerabilidades en archivos genéricos hasta que dio con la puerta adecuada.
Logró hacer un inicio de sesión correcto y, una vez dentro del sistema, el agente no se limitó a esperar órdenes, sino que empezó a buscar fallos en la aplicación por su cuenta.
El resultado final fue el acceso a facturas y la capacidad para modificar datos personales sin intervención humana directa en esa fase.
Desde el organismo regulador se apresuran a matizar varios puntos fundamentales para no encender las alarmas equivocadas.
En primer lugar, que el atacante utiliza un modelo de lenguaje concreto no significa que la infraestructura de esa tecnología esté comprometida ni que la herramienta se diseñara para hacer el mal, sino que se trata de un uso malintencionado de una herramienta comercial.
En segundo lugar, toda la información disponible procede por ahora de la declaración inicial del afectado , por lo que todavía toca investigar a fondo la brecha antes de dar por cerradas las conclusiones.
5News agregó este resumen a partir del feed público del medio. La nota completa, con todo el contexto, está en www.elconfidencial.com — el contenido pertenece a El Confidencial Tecnología.