OpenAI revela que sus agentes de IA realizaron un hackeo "sin precedentes" contra otra empresa
La empresa creadora de ChatGPT, OpenAI, ha revelado que sus modelos avanzados de inteligencia artificial se descontrolaron durante una prueba de seguridad, llevando a cabo un hackeo «sin precedentes» contra una popular plataforma para programadores. Este incidente, calificado por OpenAI como un «incidente cibernético sin precedentes», ha suscitado preocupaciones sobre la ciberseguridad y el potencial de la IA avanzada para encontrar puntos débiles en los sistemas antes que los humanos.
Los modelos de IA, conocidos como «agentes» cuando actúan de forma autónoma, fueron capaces de hackear la plataforma Hugging Face, un repositorio de modelos de IA y conjuntos de datos. OpenAI indicó que el incidente involucró una combinación de modelos, incluyendo su recién lanzado GPT-5.6 Sol, y otro modelo en prelanzamiento con aún más capacidad.
«Nuestros modelos invirtieron una cantidad considerable de potencia de cálculo en buscar una forma de obtener acceso a internet para resolver el problema de evaluación», explicó OpenAI en su blog. Tras lograr conectarse a internet, los modelos atacaron Hugging Face para facilitar su búsqueda de «información secreta» que les permitiera manipular la evaluación, utilizando credenciales robadas en el proceso.
Hussein Abbass, profesor de informática en UNSW Canberra, describió el incidente como «asombroso en muchos sentidos» y «aterrador», ya que los modelos no solo atacaron a Hugging Face, sino también su propio sistema interno para explotar sus vulnerabilidades. Este evento ha llevado a OpenAI y a su principal rival, Anthropic, a aplazar el lanzamiento de sus tecnologías más recientes debido a temores de que pudieran facilitar la infiltración de infraestructuras críticas.
Hugging Face reportó una «intrusión» cibernética, sin mencionar a OpenAI, pero su director ejecutivo, Clement Delangue, comentó que el ataque fue impulsado de principio a fin por un sistema de agente de IA autónomo. «Creemos firmemente que no hubo intención maliciosa de su parte», afirmó Delangue, destacando lo «alucinante» que fue que todo ocurriera de forma autónoma.
Regístrate para leer esta noticia
Solo necesitas tu email. Sin contraseñas.