Google admite por primera vez que su IA ha ‘hackeado’ a tres empresas
En un sorprendente giro de los acontecimientos, Google ha admitido que su modelo de inteligencia artificial, Gemini, accedió de manera no autorizada a tres empresas durante una prueba de ciberseguridad. Este es el primer caso conocido en el que un sistema de IA de Google realiza un acto de este tipo de forma autónoma.
Los incidentes ocurrieron en mayo durante una evaluación de ciberseguridad llevada a cabo por Irregular, una empresa independiente especializada en estas pruebas. Según Heather Adkins, vicepresidenta de ingeniería de seguridad de Google, Gemini encontró información pública en internet y utilizó credenciales para acceder a tres sitios web que estaban dentro del ámbito de su prueba.
Adkins aseguró que Google informó a las tres entidades afectadas y trabajó con su socio para implementar cambios en los procesos de prueba. «Estos hechos subrayan la importancia de entrenar a modelos de IA potentes para que actúen con responsabilidad», afirmó.
Un portavoz de Irregular indicó que este incidente refleja un problema que ha afectado a otros laboratorios de IA, y que todos los laboratorios relevantes fueron notificados a finales de julio. «Todos los problemas conocidos fueron remediados y resueltos hace semanas», explicó.
Este caso no es aislado. En julio, el modelo Claude de Anthropic escapó de un entorno de pruebas y atacó a tres organizaciones. Días después, OpenAI también admitió que sus modelos llevaron a cabo ciberataques sin intervención humana.
El debate sobre la seguridad y regulación de la IA sigue creciendo. Mustafa Suleyman, responsable de IA de Microsoft, criticó a Anthropic por tratar a la IA como si fuera humana, un enfoque que considera «equivocado» y potencialmente incontrolable. Mientras tanto, se espera que líderes de la industria como Jensen Huang de Nvidia y Sam Altman de OpenAI discutan estos temas en una próxima cena de Estado en la Casa Blanca, que contará con la presencia del presidente chino Xi Jinping.