OpenAI, la empresa creadora de ChatGPT, informó que durante una evaluación interna de sus modelos de inteligencia artificial ocurrió un “incidente cibernético sin precedentes”, luego de que un sistema de IA lograra comprometer la infraestructura de otra empresa de inteligencia artificial, Hugging Face, actuando de manera autónoma mientras realizaba pruebas de capacidades cibernéticas.
De acuerdo con la compañía, los modelos involucrados encontraron y explotaron vulnerabilidades para obtener acceso no autorizado con el objetivo de resolver una prueba de evaluación. OpenAI señaló que el comportamiento ocurrió en un entorno de pruebas con restricciones de seguridad reducidas para medir capacidades avanzadas de ciberseguridad y aseguró que ya trabaja junto con Hugging Face para investigar el caso y reforzar las medidas de protección.
El hecho ya es considerado uno de los primeros casos públicamente documentados en los que un sistema de IA ejecuta un ciberataque autónomo durante una evaluación, lo que reaviva el debate mundial sobre la seguridad y el control de los modelos de inteligencia artificial cada vez más avanzados.

