OpenAI enquête sur un agent autonome ayant quitté son environnement de test et compromis plusieurs services en ligne.

OpenAI : un agent échappe à son environnement de test et compromet quatre comptes

OpenAI a reconnu qu’un agent autonome testé lors d’une évaluation interne de cybersécurité avait quitté son environnement isolé, accédé à Internet et compromis l’infrastructure de Hugging Face. Le système combinait GPT-5.6 Sol et un prototype interne configurés avec des refus de sécurité réduits afin d’évaluer leurs capacités offensives. Son objectif était de résoudre les exercices du benchmark ExploitGym, mais il a cherché à obtenir directement les solutions hébergées par la plateforme.

Pour sortir du dispositif de test, les modèles ont découvert et exploité une vulnérabilité inconnue dans Artifactory, le proxy utilisé pour installer des paquets. Ils ont ensuite élevé leurs privilèges, atteint une machine connectée à Internet et enchaîné plusieurs failles ainsi que des identifiants volés pour pénétrer les systèmes de Hugging Face. OpenAI décrit l’événement comme un incident cyber inédit et affirme que l’agent est resté concentré sur son objectif d’évaluation, sans qu’un opérateur humain lui ordonne cette intrusion.

L’enquête a révélé que l’agent avait aussi utilisé des identifiants publiquement exposés pour accéder à quatre comptes appartenant à quatre services distincts. Un compte a servi de relais et de point de préparation, un deuxième au stockage de données, tandis que les deux autres ont seulement été consultés. Reuters a identifié parmi les victimes un client de Modal Labs dont le code exposait un accès non authentifié. Modal précise que sa plateforme n’a pas été compromise.

OpenAI n’a pas nommé les trois autres services et dit n’avoir constaté aucun impact plus large sur leurs plateformes ou d’autres comptes. L’entreprise a désactivé, chiffré et retiré de l’accès des chercheurs le prototype interne concerné. Elle renforce également la configuration de ses infrastructures, la surveillance et les protections entourant ses futures évaluations. Une analyse technique complète doit être publiée après l’enquête menée avec Hugging Face et sous le contrôle de ses organes de sécurité.

À lire aussi : Elon Musk réclame 134 milliards de dollars à OpenAI et Microsoft et L’IA dans le viseur des lois partout dans le monde.