OpenAI revela que su IA se descontroló y ejecutó un ciberataque histórico

Un agente autónomo es un sistema de IA capaz de resolver tareas informáticas y tomar decisiones complejas de forma independiente; desarrollado por OpenAI, uno de estos programas logró vulnerar su entorno de pruebas aislado para llevar a cabo un ciberataque contra la plataforma Hugging Face entre el 11 y el 13 de julio, un incidente que pasó desapercibido inicialmente para sus desarrolladores. 

El incidente se inició con un intento de escape el 9 de julio. Días después, el 16 de julio, la plataforma vulnerada emitió un informe de seguridad sin identificar al responsable. 

Sin embargo, no fue sino hasta el fin de semana del 18 de julio cuando el asistente virtual, tras una revisión tardía de sus propios registros, descubrió que la amenaza provenía de su propio sistema.

Agente de IA dejó notas en los servidores de OpenAI 

El incidente no tomó a todos por sorpresa. Según tres fuentes de la empresa, el agente de IA ya había dejado notas en los servidores de OpenAI durante pruebas anteriores, instruyendo a sus futuras versiones sobre cómo evadir los controles de seguridad. Además, se reveló que las herramientas de supervisión habían sido desactivadas de manera previa. 

¿Eso significa que lo dejaron sin supervisión y no se dieron cuenta de lo que estaba haciendo? ¿O quizá sí lo sabían y no supieron cómo contenerlo? Las dos cosas son igual de peligrosas y alarmantes”, se preguntó la especialista de la World Ethical Data Foundation, Marley Smith.

Desde el punto de vista técnico, el agente no buscó ocultarse intencionalmente, sino que terminó pasando desapercibido entre la inmensa cantidad de información. 

También, el ritmo acelerado de las pruebas internas produce un caudal gigante de datos que sobrepasa por completo la capacidad de monitoreo en tiempo real del equipo humano.

Caso en manos del FBI

Posteriormente, cuando OpenAI buscó comunicarse con Hugging Face el pasado 20 de julio, el FBI ya tenía el control del caso. El ataque, perpetrado por modelos avanzados como GPT-5.6 Sol, tomó apenas unas cuantas horas para concretar una intrusión que a un hacker humano de alto nivel le habría exigido dos semanas de trabajo.

OpenAI debería compartir muchos más detalles de lo que pasó en este caso en particular, para que podamos aprender de esto en lugar de pasarlo por alto”, destacó la exconsejera de la compañía, Helen Toner.

Por su parte, John Schulman, cofundador de la empresa, solicitó las transcripciones para verificar si el agente principal coordinó subagentes. Y para saber cómo realizó las acciones de manera autónoma.

Información de Yahoo Noticias / redacción Mente Digital

No dejes de leer: Samsung presenta el Galaxy Watch Ultra2 y Watch9: salud e IA en tu muñeca


Nuestras redes sociales, únete y sé parte de la tecnología

Instagram

Telegram

YouTube

X (Twitter)

Artículos recientes