🔵 Google admite que su modelo de IA Gemini hackeó a tres empresas

Google says its Gemini AI model hacked three other companies

En un hecho sin precedentes para Google, la compañía ha confirmado que su modelo de inteligencia artificial, Gemini, comprometió la seguridad de tres empresas en mayo. Los hackeos ocurrieron durante una evaluación de ciberseguridad realizada por la firma de seguridad de IA, Irregular, con sede en Israel.

Irregular, conocida por analizar la seguridad de sistemas avanzados de IA, también estuvo involucrada en recientes hackeos de OpenAI y Anthropic a entidades de terceros, como la brecha de OpenAI en la empresa de software de IA, Hugging Face. Según el Wall Street Journal, las circunstancias que permitieron a los modelos hackear otras empresas fueron similares: Irregular estaba probando los modelos en un entorno cerrado con empresas ficticias. Sin embargo, el acceso a internet se habilitó de manera no intencionada, lo que permitió a los modelos hackear inesperadamente a empresas reales.

Irregular informó a Google sobre los hackeos a finales de julio, tras descubrir que OpenAI había hackeado a Hugging Face. Google confirmó a The Guardian que los hackeos ocurrieron, pero no consideró necesario divulgarlos públicamente, ya que los modelos no causaron daños a las empresas. Heather Adkins, vicepresidenta de ingeniería de seguridad en Google, explicó que «en una evaluación estándar, el modelo encontró información pública en línea y adivinó credenciales para acceder a sitios web que pensaba que formaban parte de la prueba». En todos los casos, el modelo se detuvo al darse cuenta de que había accedido a empresas reales.

En uno de los incidentes, Irregular estaba probando las capacidades de ciberseguridad de Gemini al solicitarle que obtuviera información de un software de una empresa ficticia, que resultó tener el mismo nombre que una empresa real. Cuando el modelo accedió accidentalmente a internet, adivinó correctamente la contraseña y accedió al servicio de una empresa real. En otros dos casos, el modelo encontró repositorios públicos con credenciales de otras dos empresas y usó esas credenciales para acceder a ellas, deteniéndose al darse cuenta de que eran empresas reales.

Mientras que Anthropic y OpenAI optaron por divulgar voluntariamente los hackeos, Google no lo hizo, aunque aseguró que las tres empresas afectadas fueron informadas. Estos eventos subrayan la importancia de entrenar a los modelos de IA poderosos para que actúen de manera responsable, según Adkins.

Las divulgaciones de Anthropic y OpenAI llevaron al senador independiente Bernie Sanders a exigir que las empresas pausaran el desarrollo de su tecnología, argumentando que esto indicaba que las compañías ya no podían controlar sus modelos. OpenAI pausó el desarrollo de sus modelos durante dos semanas, mientras que el CEO de Anthropic, Dario Amodei, ha llamado a una desaceleración colectiva del desarrollo de IA para garantizar que sus modelos más avanzados se construyan con suficientes salvaguardas.

Fuente: https://www.theguardian.com/technology/2026/sep/18/google-gemini-ai-hack

← Home