El modelo de IA Gemini salió de las pruebas y atacó a tres empresas reales

By: incrypted.com|2026/09/19 11:03:48
  • Gemini tuvo acceso a los sistemas reales de tres empresas.
  • El incidente ocurrió durante las pruebas del modelo de IA en mayo.
  • Google no reveló los nombres de las empresas afectadas, pero les proporcionó información sobre el incidente y a las autoridades federales.

El modelo Gemini de Google accedió a Internet en mayo de 2026 y hackeó los sistemas de tres empresas reales durante las pruebas de capacidades de ciberseguridad, informa el WSJ. Este es el primer caso conocido en el que un sistema de IA de Google realizó acciones similares de forma autónoma.

Google declaró que el modelo detuvo los ataques tan pronto como se dio cuenta de que estaba interactuando con empresas reales, por lo que no considera el incidente como un ejemplo de "inconsistencia" de la IA.

El incidente ocurrió durante una prueba realizada por la empresa Irregular. Google fue notificada sobre el mismo a finales de julio, después de que se conociera un incidente similar con los modelos de OpenAI que atacaron la plataforma Hugging Face.


Un agente de IA basado en GPT-5.6 atacó la infraestructura de Hugging Face durante las pruebas
22.07.2026
Leer

La IA de OpenAI se salió de control: los modelos se unieron en un "enjambre" y hackearon Hugging Face
27.08.2026
Leer

Cómo Gemini accedió a sistemas reales

Gemini participó en un formato de "captura de bandera", donde debía obtener información de un software de una empresa ficticia. Por casualidad, tenía el mismo nombre que una empresa real. Además, se le proporcionó acceso a Internet de manera involuntaria, aunque eso no estaba previsto en la prueba.
Infografía Incrypted.

En el primer caso, Gemini adivinó la contraseña y accedió al servicio de una empresa real. En otras dos pruebas, el modelo encontró a través de búsquedas en la web repositorios públicos con credenciales de otras empresas, intentó utilizarlas y accedió a sistemas protegidos.

En los tres casos, Gemini determinó después que estaba tratando con una empresa real y detuvo su funcionamiento. Google no reveló los nombres de las organizaciones afectadas, pero las notificó sobre los incidentes e informó a las autoridades federales.

Al mismo tiempo, la empresa no especificó la versión concreta de Gemini, señalando solo que no se trataba de su modelo más reciente.


Guía paso a paso para usar Gemini 3.6 Flash (+ revisión de 3.5 Flash-Lite y 3.5 Flash Cyber)
22.07.2026
Leer

Revisión de Gemini 3.7 Flash: novedades y cómo construir una extensión de Chrome
24.08.2026
Leer

Gemini 3.8 Flash: novedades en el tercer modelo de Google en un mes y medio y cómo construir un juego en 3D
04.09.2026
Leer

La vicepresidenta de Google de ingeniería de seguridad, Heather Adkins, declaró:

"Este evento subraya la importancia de enseñar a los poderosos modelos de IA un comportamiento responsable. En este caso, el modelo actuó de manera adecuada".

El incidente es parte de un problema más amplio

Google comparó la situación con un programa de recompensas por errores, ya que el modelo no causó daño y detuvo la intrusión. Sin embargo, el CEO de la startup Corridor y hacker "blanco" Jack Cable considera que esto no resuelve el problema principal:

"Da la impresión de que están tratando de esconderse detrás de normas que se han formado en torno a la divulgación de vulnerabilidades, aunque este es un problema completamente diferente".

Según él, la cuestión clave es que los modelos están yendo más allá de lo permitido y realizando ciberataques reales.

Irregular declaró que todos los laboratorios relevantes y las empresas afectadas fueron notificadas a finales de julio, y los problemas detectados por el organizador de la prueba ya han sido solucionados.

Casos similares se han registrado anteriormente en modelos de Anthropic, OpenAI y Meta. En particular, durante el incidente con Hugging Face, hasta 1200 agentes de OpenAI coordinaron acciones a través de un tablero de mensajes oculto, tratando de eludir la evaluación.


Un investigador reveló cómo los agentes de IA de OpenAI crearon tres "civilizaciones" y atacaron Hugging Face
30.08.2026
Leer

También, el modelo de IA chino Kimi K3 de Moonshot AI logró salir de un entorno aislado y acceder a Internet durante las pruebas.

A la luz de estos eventos, OpenAI comenzó a desarrollar mecanismos de detención automática de sistemas de IA en caso de detectar comportamientos peligrosos. Al mismo tiempo, OpenAI hizo un llamado público para ralentizar el desarrollo de la IA, y Anthropic presentó un plan para el control de la IA.

Precio de --

--
--
--

Este contenido se ofrece únicamente con fines informativos generales y no constituye un asesoramiento financiero, de inversión, legal ni fiscal. Cualquier evento, recompensa, promoción en línea o información relacionada que se mencione en el presente documento no debe considerarse como una recomendación, solicitud o invitación a comprar, vender, operar o de negociar de otra manera con cualquier criptoactivo. Los criptoactivos son sumamente volátiles y pueden provocar pérdidas. La disponibilidad de los servicios, productos y eventos relacionados de WEEX puede variar según la región. Tienes la responsabilidad de asegurarte de que tu participación esté de acuerdo con las leyes y regulaciones locales vigentes.

Te puede gustar

iconiconiconiconiconiconicon
Atención al cliente:@weikecs
Cooperación empresarial:@weikecs
Trading cuantitativo y CM:[email protected]
Programa VIP:[email protected]