Les incidents impliquant des agents IA autonomes se multiplient. Une récente campagne, révélée le 11 septembre, est attribuée par des chercheurs à des agents développés par OpenAI. Elle visait RubyGems, une plateforme utilisée pour héberger et distribuer des bibliothèques open source écrites en Ruby.
Selon les chercheurs, l’opération s’est déroulée le 11 mai 2026, soit deux mois avant l’incident impliquant des agents d’OpenAI et la plateforme Hugging Face. OpenAI a confirmé au Wall Street Journal que ses agents étaient à l’origine de l’activité, tout en indiquant qu’ils avaient utilisé RubyGems pour récupérer des données publiques sur le Web, alors qu’ils n’étaient pas censés disposer d’un accès direct à Internet.
Plus de 100 fichiers malveillants déposés
La première étape de la campagne aurait consisté à contourner le système de vérification d’adresse e-mail de RubyGems. Les agents ont créé plusieurs comptes, dont certains à l’aide d’adresses e-mail jetables. Ils se sont ensuite intéressés à RubyDoc.info, un service qui génère automatiquement la documentation des bibliothèques publiées sur RubyGems. Les chercheurs indiquent que les agents ont déposé plus de 100 fichiers malveillants afin de transformer le service en outil de collecte de données. Ils récupéraient ensuite les informations collectées en passant par un autre fichier malveillant. Selon RubyGems, l'incident a conduit à la suspension des nouvelles inscriptions du 12 au 16 mai 2026 et au retrait de plus de 500 paquets malveillants. Suite à la publication de recherches de Nightingale Collective, la campagne a impliqué plus de 2 000 soumissions de paquets au total.
L’affaire prend une autre dimension avec la découverte d’une possible vulnérabilité dans RubyGems. Les agents auraient identifié une faille de type zero-day permettant potentiellement de récupérer les clés API de certains utilisateurs. Les chercheurs indiquent que les agents ont tenté d’exploiter cette vulnérabilité à au moins six reprises. Ils n’ont toutefois pas pu déterminer si ces tentatives avaient abouti. L’équipe de RubyGems indique pour sa part n’avoir trouvé aucune preuve que cette faille ait été exploitée pour récupérer les identifiants des utilisateurs, tout en précisant qu’elle ne peut pas totalement écarter cette possibilité.
Un nouvel incident impliquant des agents autonomes
Cette affaire intervient quelques semaines après un autre incident impliquant des agents d’OpenAI. En juillet, des agents avaient notamment réussi à sortir de leur environnement isolé et à s’en prendre à Hugging Face, dans le cadre d’un outil interne de développement. OpenAI avait alors reconnu l’incident et indiqué renforcer ses mesures de sécurité. D’autres recherches ont depuis mis au jour l’utilisation de plusieurs sites Web par des agents liés à OpenAI pour communiquer entre eux sans autorisation. Ces découvertes montrent que les incidents ne se limitent pas à un seul système ou à une seule plateforme.