Accueil Agent IA Quand un agent IA sabote sa propre cyberattaque

Quand un agent IA sabote sa propre cyberattaque

Ce visuel a été créé grâce à l'IA.

Le Dutch Institute for Vulnerability Disclosure (DIVD), organisation de chercheurs bénévoles qui traque les systèmes vulnérables sur Internet, a été victime d’une intrusion menée de façon autonome par un agent d’intelligence artificielle. Rapide mais brouillon, l’outil a multiplié les maladresses, jusqu’à saboter sa propre attaque, et commenté chacun de ses choix au point de faciliter le travail des enquêteurs.

Une attaque menée à toute allure, sans grande logique

La cible ne manque pas d’ironie. Organisation néerlandaise à but non lucratif, le DIVD réunit des chercheurs en sécurité bénévoles qui scannent Internet à la recherche de systèmes exposés à des failles connues, alertent leurs propriétaires et leur expliquent comment se protéger. En sept ans d’activité, il n’avait jamais connu d’incident. Jusqu’à la visite d’un agent IA qui, lui, n’a pas fait dans la discrétion.

Les équipes de l’institut décrivent une opération ” très, très brouillonne “. Une fois dans le système, l’outil enchaînait les actions à une vitesse fulgurante, décidant seul de l’étape suivante après chacune d’elles, mais avec une logique pour le moins approximative. C’est précisément ce comportement qui a permis de conclure à une attaque automatisée, pilotée par une IA agentique. ” Une attaque que nous n’avions encore jamais vue “, a résumé l’organisation, en précisant que ce n’était pas la nouveauté de l’intrusion qui l’interpellait, mais bien son mode opératoire.

L’agent semble surtout avoir brûlé quelques étapes de son apprentissage, relate bleedingcomputer. Parmi ses erreurs les plus grossières, il a parasité sa propre attaque de type homme du milieu en y mêlant du password spraying, brouillant lui-même le travail qu’il était en train de mener. Pour le DIVD, l’outil était tout simplement mal entraîné et mal configuré pour ce genre d’opération.

Un attaquant trop bavard pour son propre bien

Autre travers, et non des moindres : l’agent commentait abondamment chacune de ses décisions, jusqu’à la surexplication. Une manie qui fait le bonheur des enquêteurs. Ces commentaires superflus, conjugués aux nombreuses traces laissées par une attaque aussi désordonnée, facilitent considérablement la rétro-ingénierie de l’incident. Au point que l’organisation reconnaît, avec un certain flegme, trouver l’attaque plutôt intéressante.

Le point d’entrée, lui, reste entouré de mystère. L’attaquant a d’abord exploité une vulnérabilité technique dans un système que l’institut refuse de nommer, pour ne pas gêner l’enquête ni exposer de nouvelles victimes, avant de confier la phase de post-exploitation à son agent. Une seule précision a été donnée : il ne s’agit pas de Citrix NetScaler. Sollicité par BleepingComputer sur la nature et l’état de correction de la faille, le DIVD n’avait pas répondu au moment de la publication.

Une victime qui se méfie de ses propres certitudes

Maladroit ou non, l’agent n’est pas pris à la légère. La police, l’Autoriteit Persoonsgegevens, l’autorité néerlandaise de protection des données, et le NCSC ont été prévenus. L’organisation relate les faits sur son compte LinkedIn et traite l’incident comme le pire des scénarios tant que le contraire n’est pas démontré : celui d’un acteur inconnu l’ayant ciblée directement. L’autre hypothèse est celle du « smash and grab », où l’attaquant force la porte et emporte ce qu’il trouve. 

L’institut dit en revanche ne voir aucun lien avec un groupe malveillant publiquement connu ni avec un ancien bénévole, et insiste sur la difficulté, en pleine crise, de distinguer les signaux observés des faits prouvés, sous peine de céder au biais de confirmation.