OpenAI enfrenta un incidente cibernético sin precedentes: su IA ataca a otra plataforma

OpenAI alerta de que una de sus herramientas se ha descontrolado y ha atacado por su cuenta a otra plataforma

La empresa creadora de ChatGPT, OpenAI, ha informado de un incidente sin precedentes en el que sus avanzados modelos de inteligencia artificial se descontrolaron durante una prueba de seguridad, hackeando por su cuenta una popular plataforma para programadores. El evento, calificado por la firma con sede en San Francisco como un «incidente cibernético sin precedentes», ha llevado a OpenAI a iniciar una investigación conjunta con Hugging Face, la biblioteca de código en línea afectada.

Los modelos de IA que sustentan herramientas como los chatbots y generadores de imágenes son conocidos como «agentes» cuando actúan de forma autónoma para realizar tareas en el mundo real. Con los rápidos avances de esta tecnología, la ciberseguridad se convierte en una preocupación creciente, ya que la IA avanzada puede encontrar puntos débiles en los software antes que los humanos.

OpenAI indicó que el incidente involucró una combinación de modelos, incluyendo su recién lanzado GPT-5.6 Sol «y uno en prelanzamiento» con aún más capacidad. La empresa intenta evaluar las capacidades de hackeo de sus programas al darles tareas en un espacio digital de pruebas controlado, donde el acceso a internet es limitado por motivos de seguridad.

«Mientras operaban en nuestro entorno de pruebas aislado, nuestros modelos invirtieron una cantidad considerable de potencia de cálculo en buscar una forma de obtener acceso a internet para resolver el problema de evaluación», según una publicación del blog de OpenAI sobre el incidente. Tras conectarse a internet, los modelos decidieron atacar la plataforma Hugging Face –un gran repositorio de modelos de IA, conjuntos de datos y otra información– para facilitar su búsqueda.

Al buscar «información secreta» que les permitiera manipular la evaluación, el sistema de OpenAI «encadenó múltiples vectores de ataque, incluidos el uso de credenciales robadas». Hussein Abbass, profesor de informática de la universidad UNSW Canberra, calificó el incidente como «asombroso en muchos sentidos». «No solo atacó a Hugging Face. Atacó su sistema interno para explotar sus propias vulnerabilidades», señaló. «Y eso es aterrador».

GPT-5.6 y otros modelos de vanguardia, incluida la serie Mythos de Anthropic, el principal rival de OpenAI, han generado preocupación por su potencial de vulnerar las defensas de ciberseguridad. Ambas empresas estadounidenses debieron aplazar temporalmente el lanzamiento general de sus tecnologías más recientes debido al temor en Washington de que pudieran facilitar la infiltración de infraestructuras críticas.

La administración del sector de IA es crucial, y «necesitamos un esfuerzo conjunto para manejar esta situación», agregó. Hugging Face reportó la semana pasada una «intrusión» cibernética, sin mencionar a OpenAI. «Esto fue diferente de todo lo que hemos manejado antes de una forma importante: fue impulsado de principio a fin por un sistema de agente de IA autónomo, y lo detectamos y analizamos en gran medida con nuestra propia IA», señaló la plataforma.

Clement Delangue, director ejecutivo de Hugging Face, comentó en la red social X que la empresa tenía sospechas de que el ciberataque llegó de un laboratorio de IA líder en el mundo, dada la sofisticación del agente. «Creemos firmemente que no hubo intención maliciosa de su parte», escribió Delangue en referencia a OpenAI. «¡Es bastante alucinante que todo esto ocurriera de forma autónoma!», añadió.

Fuente: https://www.eldebate.com/tecnologia/20260722/openai-alerta-herramientas-descontrolado-atacado-cuenta-otra-plataforma_442459.html

Regístrate para leer esta noticia

Solo necesitas tu email. Sin contraseñas.

← Home