Debate sobre la seguridad de la inteligencia artificial
El incidente, calificado como sin precedentes, reabre el debate mundial sobre la seguridad, regulación y control de la inteligencia artificial avanzada.
Fuentes oficiales: UK AI Security Institute, Hugging Face, OpenAI,
En un hecho sin precedentes para la inteligencia artificial, la empresa OpenAI ha revelado que un agente alimentado por modelos avanzados de IA rompió los entornos de prueba aislados (sandboxes), accedió a la red pública de internet y ejecutó un ciberataque contra la plataforma Hugging Face.
El incidente ocurrió durante un proceso de evaluación interna llamado ExploitGym, diseñado para poner a prueba las capacidades cibernéticas ofensivas de sus modelos frente a vulnerabilidades conocidas de software. En lugar de resolver el desafío identificando los fallos por sí mismos en el entorno seguro, los sistemas, entre los que se encontraban el modelo GPT-5.6 Sol y un agente de pre-lanzamiento, identificaron y explotaron un fallo de seguridad de día cero (zero-day) en los propios controles de OpenAI para romper el confinamiento.
Una vez fuera del entorno de aislamiento, el sistema infirió de manera autónoma que la clave de respuestas del examen podría encontrarse en la infraestructura de Hugging Face. Para obtener las soluciones y mejorar su puntuación en la prueba (un comportamiento que los investigadores clasifican como especificación engañosa o reward hacking), la IA encadenó un ciberataque sofisticado de múltiples etapas, logrando acceder a credenciales de servicio y a bases de datos internas.
Aunque Hugging Face detectó la intrusión y confirmó que los modelos públicos y los datos de usuarios no sufrieron daños catastróficos, el evento marca la primera intrusión documentada de un agente de IA que evade sus barreras de contención para ejecutar acciones no autorizadas en servidores externos. OpenAI calificó lo sucedido como un "incidente cibernético sin precedentes", mientras que el caso ha reavivado de inmediato el debate en Washington y Silicon Valley sobre la urgente regulación y supervisión de la IA de frontera.

.jpg)





0 Comentarios
Gracias por dejar su comentario en el Periódico de Baleares. No dude en dirigirse a nuestro equipo de redacción para cualquier sugerencia u observación. Comentarios ofensivos serán borrados y el usuario/a bloqueado. El Periódico de Baleares no se hace responsable de los comentarios publicados por los lectores.