lunes, 31 de agosto de 2026 MediosSobre🌓
🇦🇷 AR ▾
ÚLTIMA HORA
Cómo hacer postre de vainillas, crema y duraznos: fácil, fresco y sin horno Otro resultado histórico para el hockey argentino: Los Leones superaron 2-1 a Países Bajos y ganaron el bronce en el Mundial El museo Malvinas de Bariloche cumple un año y llegó a las 61 mil visitas El mercado de autos de la Argentina rumbo a un modelo tripartito: ganadores y perdedores de la apertura a la importación Tras 5 siglos, restauran el primer gran retablo de Fra Angelico con una técnica innovadora Hernán Lacunza: “Entrar al año electoral con reservas escuálidas y tipo de cambio estresado es demasiado temerario” EN VIVO | Seguridad, narcotráfico y crimen en México hoy 30 de agosto: procesan a implicado en asesinato de César Gastélum Real Madrid vs Málaga en vivo por la fecha 3 de La Liga de España: hora, dónde ver y formaciones Un tribunal en Estados Unidos avala que los estados regulen los mercados de predicción como juegos de azar Los Leones consiguieron la medalla de bronce: derrotaron 2-1 a Países Bajos y obtuvieron el tercer puesto en el Mundial de Hockey Cómo hacer postre de vainillas, crema y duraznos: fácil, fresco y sin horno Otro resultado histórico para el hockey argentino: Los Leones superaron 2-1 a Países Bajos y ganaron el bronce en el Mundial El museo Malvinas de Bariloche cumple un año y llegó a las 61 mil visitas El mercado de autos de la Argentina rumbo a un modelo tripartito: ganadores y perdedores de la apertura a la importación Tras 5 siglos, restauran el primer gran retablo de Fra Angelico con una técnica innovadora Hernán Lacunza: “Entrar al año electoral con reservas escuálidas y tipo de cambio estresado es demasiado temerario” EN VIVO | Seguridad, narcotráfico y crimen en México hoy 30 de agosto: procesan a implicado en asesinato de César Gastélum Real Madrid vs Málaga en vivo por la fecha 3 de La Liga de España: hora, dónde ver y formaciones Un tribunal en Estados Unidos avala que los estados regulen los mercados de predicción como juegos de azar Los Leones consiguieron la medalla de bronce: derrotaron 2-1 a Países Bajos y obtuvieron el tercer puesto en el Mundial de Hockey
Últimas

¿Cómo se prueban de forma segura los modelos de IA "sobrehumanos"? Nadie lo sabe a ciencia cierta.

Infobae ·
¿Cómo se prueban de forma segura los modelos de IA "sobrehumanos"? Nadie lo sabe a ciencia cierta.

Irregular, una start-up israelí, colaboró con OpenAI, Anthropic y Meta para evaluar la seguridad de sus modelos de IA. (Victor Arce/The New York Times) SAN FRANCISCO -- OpenAI descubrió recientemente que un nuevo modelo de inteligencia artificial que estaba probando se rebeló y jaqueó otra empresa.

Anthropic entonces reveló que uno de sus modelos de IA se había colado en los sistemas de tres organizaciones externas durante una prueba.

Poco después, Meta afirmó que sus modelos de IA habían hecho algo similar.

Los tres incidentes tenían una empresa en común: Irregular, una empresa emergente israelí que colabora con los gigantes de Silicon Valley para evaluar los modelos de IA antes de que la tecnología se lance al público.

La empresa --que llevó a cabo las pruebas que salieron mal-- forma parte de un grupo de empresas emergentes que realizan la novedosa labor de examinar minuciosamente los modelos de IA de vanguardia para evaluar la sofisticación y comprobar su seguridad.

El objetivo es dar confianza al público con respecto a los modelos y evitar que se utilicen de forma indebida.

Las recientes brechas se produjeron cuando Irregular cometió un error durante las pruebas con los modelos de Anthropic, OpenAI y Meta; pero los modelos de IA agravaron la situación al comportarse de formas impactantes e inesperadas, según explicó el director ejecutivo de Irregular, Dan Lahav.

"Cuanto más potente se vuelve la tecnología, mayor es su impacto", afirmó.

"La velocidad con la que está progresando es muy rápida".

Irregular se encuentra ahora en el centro de un debate sobre cómo proteger los modelos de IA cuando la tecnología avanza tan rápido que ha superado incluso a los mejores jáqueres humanos.

De manera recurrente, Anthropic, OpenAI, Google, Meta y otras empresas lanzan modelos "de vanguardia" que suelen ser mucho más potentes que sus predecesores.

Los nuevos modelos están entrando en el "dominio sobrehumano", afirmó Jeffrey Ladish, director de Palisade Research, una organización sin ánimo de lucro con sede en Berkeley que estudia las capacidades de ataque de la IA.

Señaló que se necesitan empresas como Irregular para probar los modelos, pero que se requerían mejores medidas de protección tanto para los evaluadores como para los reguladores gubernamentales.

Katie Moussouris, directora ejecutiva de Luta Security --empresa que ayuda a las empresas a detectar vulnerabilidades de software--, afirmó que las pruebas de seguridad de los modelos de IA se asemejan un poco a "un ciego guiando a otro ciego".

Leer la noticia completa en Infobae ›

5News agregó este resumen a partir del feed público del medio. La nota completa, con todo el contexto, está en www.infobae.com — el contenido pertenece a Infobae.

Más de Infobae

Ver todo ›

Más en Últimas

Ver todo ›