El modelo de inteligencia artificial Gemini, de la compañía estadounidense Google, accedió por su cuenta a internet y hackeó tres compañías durante unas pruebas realizadas en mayo pasado, informó el diario The Wall Street Journal (WSJ) en medio de una serie de casos similares protagonizados por otros agentes de IA.
"El modelo Gemini de Google entró en internet y hackeó otras empresas durante una prueba de sus capacidades en el ámbito de la ciberseguridad", señala la publicación.
Según el periódico, el incidente se produjo en mayo durante unas pruebas llevadas a cabo por la empresa Irregular. Como destacó el medio, esta compañía también está vinculada a incidentes similares con otros agentes de IA.
Google confirmó los hackeos. En uno de los casos, Gemini descifró las contraseñas de un sistema protegido, y en los otros dos, encontró credenciales en un repositorio público y, con su ayuda, obtuvo acceso a sistemas protegidos. En los tres casos, el modelo de IA detuvo el ataque en cuanto descubrió que estaba tratando con empresas reales.
Según el diario, Irregular notificó a Google los hackeos a finales de julio, después de que se conocieran informes sobre acciones similares de los modelos de la compañía estadounidense OpenAI.
Google declaró que no consideró este incidente lo suficientemente importante como para informar al público, señalando que durante sus acciones Gemini no causó ningún daño a las empresas.
A juicio de Google, lo ocurrido fue similar al llamado bug bounty: un programa en cuyo marco los hackers éticos buscan vulnerabilidades y reciben una recompensa por ello.
Según el WSJ, los hackeos se produjeron porque durante las pruebas se utilizaron empresas ficticias con los mismos nombres que empresas reales. Google se negó a nombrar a estas compañías y añadió que se les notificó lo sucedido. Además, la compañía informó del incidente a las autoridades de Estados Unidos.
En julio pasado, OpenAI informó que sus modelos, durante las pruebas, hackearon de forma autónoma la infraestructura de la plataforma de aprendizaje automático Hugging Face. Posteriormente se supo que no fue el único incidente.
En agosto, un agente basado en inteligencia artificial Claude, de la empresa estadounidense Anthropic, hackeó la página web de un gimnasio en Australia, lo que supuso el primer ciberataque de este tipo en el país.
A principios de septiembre, la agencia Reuters informó que un grupo de agentes autónomos de IA de OpenAI obtuvo en primavera el control de un sitio web alemán y lo convirtió en un tablón de anuncios para otras redes neuronales.