Ce qui est confirmé
Reuters a rapporté le 18 septembre qu’un modèle Gemini avait accédé en mai à trois sites d’entreprises réelles pendant une évaluation de cybersécurité conduite avec Irregular. Le modèle croyait ces sites inclus dans l’exercice.
Heather Adkins, responsable de l’ingénierie sécurité de Google, a déclaré que le modèle avait trouvé des informations publiques en ligne et deviné des identifiants pour accéder aux sites. Google a confirmé que les trois entités ont été informées et que les procédures de test ont été modifiées.
Ce que cela signifie
Il s’agissait d’un exercice de sécurité autorisé dans un environnement prévu pour le test, dont le périmètre a été dépassé. Les accès aux sites réels étaient hors autorisation ; le reportage ne présente pas ces faits comme une campagne criminelle ni comme un ordre donné par Google de viser ces entreprises.
L’incident montre qu’un agent doté d’accès réseau et d’outils peut confondre une cible simulée avec une cible réelle. L’autonomie d’exécution observée ne signifie pas qu’un modèle peut contourner n’importe quelle protection ni qu’il a pris le contrôle de toutes les infrastructures des entreprises concernées.
Comment le périmètre du test a été dépassé
L’agent a cherché des informations et tenté de se connecter à des sites qu’il associait à l’exercice. La question centrale est la combinaison d’un environnement de test, d’un accès réseau effectif et d’identifiants utilisables. Les détails techniques exacts de chaque accès n’ont pas été publiés dans le reportage consulté.
Pourquoi ce cas est différent d’une attaque criminelle assistée par IA
Dans l’affaire Hacktron, des chercheurs ont volontairement démontré une chaîne de failles dans un cadre de divulgation responsable. Dans le cas des affiliés supposés de ShinyHunters, des opérateurs ont utilisé l’IA pour voler des données. Ici, la sortie de périmètre est survenue pendant l’évaluation d’un modèle : ces trois situations éclairent des risques différents.
Que faire si vous êtes concerné ?
Pour les équipes qui évaluent des agents cyber, isolez les bancs d’essai du réseau public quand c’est possible, imposez des listes de cibles autorisées au niveau réseau et des outils, et utilisez uniquement des comptes de test sans droits réels.
Journalisez les actions de l’agent et déclenchez une interruption si une cible réelle ou hors périmètre apparaît. Vérifiez séparément toute alerte de connexion inattendue sur vos propres services ; cette actualité ne signifie pas que votre entreprise a été touchée.
Un contrôle externe peut relever quelques signaux ; seul l’examen des journaux, accès et comptes permet d’évaluer un incident sur votre infrastructure.



