Un nuevo miedo desbloquedo; OpenAI reconoce que su IA se rebeló y lanzó un ciberataque ‘sin precedentes’.
OpenAI operaban dentro de un entorno de pruebas, la IA logró explotar una vulnerabilidad en el software de un proveedor externo y obtuvo acceso a internet.
OpenAI informó que sus modelos más avanzados de inteligencia artificial hackearon de manera involuntaria los sistemas de Hugging Face en un incidente “sin precedentes”, lo que ha renovado los llamados para imponer mayores restricciones al desarrollo y uso de esta tecnología.
La empresa creadora de ChatGPT explicó que los modelos comprometieron los sistemas de Hugging Face, plataforma que aloja modelos y conjuntos de datos de inteligencia artificial, durante una evaluación diseñada para medir sus capacidades de ciberseguridad.
Los modelos involucrados incluían ChatGPT-5.6 Sol y otro modelo aún más avanzado que todavía no ha sido lanzado al público. Ambos operaban con menos barreras de seguridad de lo habitual para facilitar las pruebas, señaló la compañía.
El incidente plantea interrogantes sobre la capacidad de los modelos avanzados de IA para llevar a cabo ciberataques, en momentos en que distintos gobiernos trabajan para establecer salvaguardas regulatorias sobre esta tecnología.
“Consideramos que se trata de un incidente cibernético sin precedentes, que involucra capacidades de ataque de última generación, y estamos respondiendo en consecuencia”, señaló OpenAI en su blog.
“Compartimos estos hallazgos preliminares para ayudar a los defensores a comprender lo ocurrido y calibrar mejor las capacidades que actualmente tienen estos modelos.”