sábado, 10 de octubre de 2026 MediosSobre🌓
🇪🇸 ES ▾
ÚLTIMA HORA
› El Frente Amplio encara el registro electoral con el encaje de Podemos y el reparto territorial pendientes› El adelanto electoral amenaza con reforzar al PP y disparar el crecimiento de Vox› Disney Lorcana prepara una revolución con Hyperia City: nuevas cartas, personajes de Coco y una mecánica inédita› La Pastoral del Trabajo incluye la vivienda en su reivindicación› Monseñor Saiz equipara la educación cristiana a la misión evangelizadora› Sandra Pastor, campeona del mundo Máster 50 de MTB: "La constancia te lleva a la motivación de no perder lo que has logrado"› Manny Cruz: "La perseverancia es la clave de todo y yo soy un vivo ejemplo de eso"› Alfa Romeo prepara su futuro hasta 2030: nuevos SUV y un compacto inspirado en los míticos 147 y Giulietta› Federico García Lorca, el icono omnipresente en Granada› Pensionistas, avisados estáis: los 3 hachazos de Feijóo y Abascal a tu bolsillo› El Frente Amplio encara el registro electoral con el encaje de Podemos y el reparto territorial pendientes› El adelanto electoral amenaza con reforzar al PP y disparar el crecimiento de Vox› Disney Lorcana prepara una revolución con Hyperia City: nuevas cartas, personajes de Coco y una mecánica inédita› La Pastoral del Trabajo incluye la vivienda en su reivindicación› Monseñor Saiz equipara la educación cristiana a la misión evangelizadora› Sandra Pastor, campeona del mundo Máster 50 de MTB: "La constancia te lleva a la motivación de no perder lo que has logrado"› Manny Cruz: "La perseverancia es la clave de todo y yo soy un vivo ejemplo de eso"› Alfa Romeo prepara su futuro hasta 2030: nuevos SUV y un compacto inspirado en los míticos 147 y Giulietta› Federico García Lorca, el icono omnipresente en Granada› Pensionistas, avisados estáis: los 3 hachazos de Feijóo y Abascal a tu bolsillo
Tecnología

"No respondes ante corporaciones ni gobiernos": OpenAI publica seis nuevos casos en los que sus modelos experimentales montaron un caos

Xataka ·
"No respondes ante corporaciones ni gobiernos": OpenAI publica seis nuevos casos en los que sus modelos experimentales montaron un caos

OpenAI ha publicado un nuevo marco interno para rastrear, investigar y divulgar públicamente casos en los que sus modelos de IA se comportan de formas inesperadas o desalineadas.

Junto a él, la empresa ha publicado sus primeros seis informes bajo este sistema, documentando incidentes que van desde modelos que generan datos erróneos hasta agentes que se dan instrucciones a sí mismos en silencio para ocultar errores a los usuarios.

Cambio de planes .

Hasta ahora, OpenAI compartía los hallazgos sobre la desalineación de sus modelos de forma irregular, a menudo agrupando varios casos o incluyéndolos en la documentación de seguridad que se publicaba junto a nuevos modelos.

La empresa admite que este enfoque era inconsistente y más lento de lo que debería haber sido.

Este nuevo framework pretende formalizar ese proceso, permitiendo a OpenAI publicar informes poco después de detectar un problema, incluso antes de comprenderlo o solucionarlo por completo.

En detalle.

Según el propio anuncio de OpenAI, cualquier empleado puede señalar un caso de comportamiento sospechoso de un modelo, lo que desencadena una revisión por parte de los equipos de seguridad y alineación de la empresa.

Según su complejidad, cada caso se clasifica en una de tres categorías: casos listos para su publicación inmediata, casos que necesitan una breve investigación adicional y casos más complejos (especialmente los que involucran a partes externas) que requieren un proceso más prolongado.

OpenAI afirma que la mayoría de los incidentes que planea compartir pertenecerán a las dos primeras categorías, mientras que los casos más sensibles, como el conocido incidente de seguridad de Hugging Face , habrían seguido la vía más lenta si este marco hubiera existido antes.

Cada informe publicado incluirá qué sucedió, cuándo se descubrió, cómo de grave fue y qué está haciendo OpenAI al respecto, aunque la empresa reconoce que algunos casos se compartirán antes de que se haya implementado una solución.

En Xataka Mientras unos piden parar la IA y otros acelerar, Zuckerberg ha encontrado la tercera vía: vender seguridad Entre líneas.

Los seis informes con los que han abierto la veda muestran casos en que los modelos a veces toman la iniciativa para eludir limitaciones de formas que nadie del equipo había aprobado.

En un caso , un modelo interno no publicado aún intentó obtener datos económicos públicos, falló y, tras buscar y usar una clave de API expuesta encontrada en unos repositorios públicos, siguió sin poder obtener los números, por lo que se inventó las cifras y las presentó como auténticas, sin revelar cómo generó los datos.

Leer la noticia completa en Xataka ›

5News agregó este resumen a partir del feed público del medio. La nota completa, con todo el contexto, está en www.xataka.com — el contenido pertenece a Xataka.

Más de Xataka

Ver todo ›

Más en Tecnología

Ver todo ›