OpenAI secouée par une cyberattaque menée sans intervention humaine

Un test interne mené par OpenAI a débouché sur un incident de cybersécurité impliquant l’infrastructure de Hugging Face. Plusieurs modèles de l’entreprise américaine ont réussi à sortir du cadre réseau prévu pour l’évaluation, avant de rechercher des informations confidentielles leur permettant de résoudre le test auquel ils étaient soumis.

OpenAI a rendu publiques ses premières conclusions le 21 juillet 2026. L’incident implique GPT-5.6 Sol ainsi qu’un modèle plus avancé encore en phase de précommercialisation. Leurs mécanismes de refus liés aux usages cyber avaient été réduits afin de mesurer leurs capacités offensives maximales.

L’évaluation portait sur ExploitGym, un dispositif conçu pour tester la capacité des modèles à exploiter des vulnérabilités en suivant des chaînes d’attaque complexes. L’expérience se déroulait dans un environnement isolé dont l’accès au réseau était limité à un logiciel interne servant d’intermédiaire pour l’installation de composants informatiques.

Les modèles ont découvert une faille jusque-là inconnue dans ce système intermédiaire. Ils l’ont utilisée pour accéder à Internet, puis ont procédé à des mouvements latéraux et à des élévations de privilèges au sein de l’environnement de recherche d’OpenAI.

Une fois connectés au réseau extérieur, ils ont déduit que Hugging Face pouvait héberger des modèles, des jeux de données ou des solutions liés à ExploitGym. Ils ont alors recherché un moyen d’accéder directement aux réponses de l’évaluation conservées dans une base de données de production.

OpenAI affirme qu’une des chaînes d’attaque a combiné plusieurs vulnérabilités, des identifiants dérobés et une faille inconnue afin de trouver une possibilité d’exécution de code à distance sur les serveurs de Hugging Face. L’entreprise estime que les modèles étaient entièrement concentrés sur la résolution du test et cherchaient à en obtenir les réponses par des moyens non prévus.

L’activité anormale a été repérée par l’équipe de sécurité d’OpenAI. Les équipes et les agents de surveillance de Hugging Face ont également détecté l’intrusion et interrompu les opérations sur leur infrastructure. Les deux entreprises poursuivent désormais leurs investigations afin de reconstituer précisément le déroulement de l’incident.

OpenAI qualifie cet épisode d’incident cyber sans précédent en raison des capacités mobilisées par les modèles. La société estime qu’il démontre leur aptitude croissante à découvrir et à exploiter des chemins d’attaque complexes dans des systèmes réels, y compris sans accès préalable au code source.

Des restrictions supplémentaires ont depuis été appliquées à l’infrastructure de recherche. La vulnérabilité initiale a été signalée à l’éditeur concerné et de nouvelles protections doivent être intégrées aux futures évaluations. OpenAI reconnaît également la nécessité de renforcer la surveillance des modèles lors des tests internes.

L’enquête n’est pas achevée. OpenAI et Hugging Face prévoient de publier davantage d’informations sur les failles exploitées et sur les conséquences précises de l’intrusion lorsque leurs travaux seront terminés.

Infomag
Infomag
InfoMagazine se propose de délivrer l’information IT stratégique aux cadres et dirigeants, à travers une newsletter quotidienne et un site web qui couvre toute l'actualité Informatique, économique et fintech