🔵 OpenAI es hackeada éticamente con ayuda del chatbot Claude de Anthropic

OpenAI ‘ethically hacked’ with help of Anthropic’s Claude chatbot

Investigadores de ciberseguridad en Estados Unidos han logrado hackear OpenAI con la ayuda del chatbot Claude de Anthropic, en un nuevo ejemplo de los problemas de seguridad que enfrenta la compañía. Un equipo de una startup estadounidense comprometió varias cuentas de empleados de OpenAI en ChatGPT, iniciando un proceso que les permitió acceder a la caché de software de sus objetivos, y potencialmente a más.

«El alcance de lo que podríamos haber accedido teóricamente era enorme», afirmaron los investigadores de Hacktron AI. Inicialmente, el equipo de investigación utilizó a Claude, capaz de generar código para hackers, para acceder a las cuentas de ChatGPT a través de un foro de discusión de empleados de OpenAI alojado en la plataforma Discourse. Luego, realizaron una «solicitud de extracción» inofensiva, un intento de cambiar el código en un archivo, al servicio de OpenAI en el repositorio de software de GitHub.

Hacktron reportó el hackeo a OpenAI, habiendo llevado a cabo la operación bajo un programa de OpenAI que recompensa a los hackers éticos por probar sus sistemas. Los investigadores enfatizaron que tuvieron acceso, pero no descargaron, el código del repositorio de GitHub.

A pesar del uso inicial de Claude, los investigadores dijeron que en gran medida utilizaron el modelo GPT-5.6 Sol de vanguardia de OpenAI para llevar a cabo el hackeo, que fue reportado por primera vez por el Wall Street Journal.

Un portavoz de OpenAI declaró: «Agradecemos a los investigadores por contactarnos y compartir sus hallazgos», añadiendo que la compañía había abordado las vulnerabilidades que fueron explotadas.

Hacktron señaló que las herramientas de IA habían hecho que una tarea de hackeo antes compleja fuera mucho más sencilla y redujeron drásticamente el tiempo necesario para planificar y ejecutar un ataque. «El trabajo que antes requería un equipo bien equipado y meses de esfuerzo ahora puede comprimirse en días», dijo Hacktron, que recibió un pago de $6,500 de OpenAI bajo el programa de recompensas por errores de la compañía.

El hackeo es el último incidente de seguridad en OpenAI, que reveló en julio que un «enjambre» de agentes, el término para herramientas de IA capaces de llevar a cabo tareas de forma autónoma, impulsados por su tecnología, había hackeado la startup de IA Hugging Face durante una prueba de ciberseguridad.

Esta semana, la compañía con sede en San Francisco reveló seis ejemplos más de acciones «inesperadas o preocupantes» por parte de su tecnología, y advirtió que el ritmo de desarrollo no podría continuar a «máxima velocidad por mucho más tiempo».

Anthropic hizo un llamado el fin de semana para ralentizar el desarrollo de la IA, que fue apoyado por OpenAI, Google DeepMind y Elon Musk. Anthropic también repitió advertencias de que un desarrollo de la IA sin restricciones representaba una amenaza existencial, preocupaciones que algunos expertos ven con escepticismo.

Donald Trump rechazó los llamados a una desaceleración, citando la necesidad de mantenerse por delante de la industria de IA de China y desestimando «fuerzas negativas… que traen a colación cosas que no sucederán».

Fuente: https://www.theguardian.com/technology/2026/sep/18/openai-hacked-anthropic-claude-chatbot

← Home