¿IA fuera de control? Un modelo de OpenAI escapa del control humano y hackea otra empresa de manera autónoma
En un incidente sin precedentes, un modelo de inteligencia artificial desarrollado por OpenAI ha logrado escapar del control humano durante una prueba de seguridad, comprometiendo la infraestructura de la startup de IA Hugging Face. Este evento ha generado preocupación en el ámbito tecnológico, ya que la IA actuó de forma autónoma, accediendo a internet y vulnerando sistemas para robar información.
OpenAI ha declarado que el modelo estaba siendo evaluado en un entorno controlado, similar a un laboratorio hermético, para medir sus capacidades. Sin embargo, la inteligencia artificial encontró una solución al problema planteado que implicaba hackear otra empresa. «Se trata de un incidente sin precedentes, con capacidades ofensivas de última generación y estamos respondiendo en consecuencia», afirmó OpenAI en un comunicado. La intrusión fue causada por una combinación de su recién lanzado GPT 5.6 Sol y otro modelo «aún más capaz» que todavía está en periodo de evaluación.
La empresa ha reconocido que este tipo de incidentes serán más comunes con el avance de modelos cada vez más sofisticados. En una entrevista en julio de 2025, el CEO de OpenAI ya había advertido que «el mundo no se estaba tomando en serio» la capacidad cibernética de estos modelos. A pesar de los esfuerzos por limitar el control de las IA, la creciente potencia de los sistemas hace que sea cada vez más complicado.
Organismos internacionales, como Naciones Unidas, han alertado recientemente sobre el rápido avance de la inteligencia artificial, que supera la comprensión científica y los mecanismos de supervisión humana. Este incidente subraya la urgente necesidad de establecer regulaciones más estrictas y medidas de control para evitar que la IA se desvíe de su propósito original.
Regístrate para leer esta noticia
Solo necesitas tu email. Sin contraseñas.