Des chercheurs ont utilisé Claude pour pirater OpenAI.

| 22 septembre 2026
Des chercheurs ont utilisé Claude pour pirater OpenAI.

On a déjà entendu parler des agents d'IA d'OpenAI qui semaient la pagaille et pirataient d'autres entreprises . Désormais, une société de cybersécurité a retourné la situation contre l'opérateur de ChatGPT en utilisant l'IA pour pirater OpenAI elle-même.

Ce piratage, qui a également révélé une faille affectant des dizaines d'autres services en ligne majeurs, a été mené dans le cadre de recherches en sécurité. OpenAI a rémunéré les chercheurs pour avoir signalé une vulnérabilité dans ses systèmes via son programme de primes aux bogues.

Des chercheurs de Hacktron, fournisseur d'outils de cybersécurité, ont relaté leurs investigations à la mi-septembre. Quelques mois auparavant, ils avaient commencé à rechercher des failles de sécurité chez des entreprises développant des modèles d'IA de pointe, c'est-à-dire des modèles très performants comme ceux qui alimentent ChatGPT et Claude.

Grâce à Claude d'Anthropic, les chercheurs sont passés de l'étude d'une faille dans le traitement d'images à l'accès à un dépôt de logiciels interne d'OpenAI en moins de 72 heures. Ils ont délibérément évité de consulter des informations sensibles.

Pour pénétrer le système d'OpenAI, les chercheurs Harsh Jaiswal, Mohan Pedhapati et Rahul Maini ont découvert deux vulnérabilités qu'ils ont combinées. La première n'était pas spécifique à OpenAI ; il s'agissait d'un bug dans la fonctionnalité de téléchargement d'images du logiciel de forum communautaire Discourse.

Cette fonctionnalité traite les images téléchargées par les utilisateurs et repose sur une bibliothèque logicielle de bas niveau appelée libheif. Le téléchargement d'une image spécialement conçue pourrait exploiter une faille de sécurité dans cette bibliothèque, permettant ainsi à un attaquant de prendre le contrôle du serveur Discourse.

Après que Hacktron a exploité cette vulnérabilité pour compromettre le serveur Discourse d'OpenAI, une seconde vulnérabilité est apparue. Il s'agissait d'une faille dans le système d'authentification unique (SSO) d'OpenAI, qui permet d'accéder à un service à l'aide d'un compte provenant d'un autre.

La faille d'authentification unique (SSO) a permis à Hacktron d'accéder aux comptes ChatGPT et Codex des personnes connectées au forum Discourse d'OpenAI. OpenAI utilise ce forum pour le support communautaire ; cette faille a donc potentiellement compromis un grand nombre de comptes. Codex est un outil de programmation pour l'IA qui aide les développeurs de logiciels à travailler avec le code.

Il n'y avait pas que des utilisateurs non professionnels connectés à ce système ; des employés d'OpenAI étaient également connectés, permettant ainsi à Hacktron d'accéder au compte de l'un d'eux. Le compte Codex de cette personne était lié à l'organisation GitHub d'OpenAI. GitHub est un service en ligne utilisé par les développeurs pour stocker et collaborer sur des logiciels.

Cela a permis aux chercheurs d'accéder au dépôt de logiciels interne d'OpenAI.

Les chercheurs n'ont commis aucun acte préjudiciable avec cet accès. Ils souhaitaient simplement prouver qu'ils avaient compromis OpenAI. Ils ont donc utilisé le compte Codex de l'employé pour créer une simple demande de fusion (une proposition de modification logicielle) dans un dépôt interne d'OpenAI.

OpenAI a corrigé sa partie du problème environ 14 heures après la soumission du rapport initial de Hacktron. L'entreprise a ensuite versé aux chercheurs une prime de 6 500 $ pour la correction de la faille côté OpenAI.

Quelles sont les implications pour la cybersécurité ?

Le piratage éthique de ce type est courant, mais ce piratage présente certains aspects intéressants qui le distinguent de beaucoup d'autres.

Premièrement, Hacktron a utilisé l'IA pour faciliter ses efforts. Initialement, l'entreprise s'est servie d'Opus 4.8, un des modèles Claude récents d'Anthropic, pour découvrir la faille dans libheif. Cependant, ce modèle ne lui a pas permis de développer un exploit fiable fonctionnant contre la version par défaut de Discourse.

Anthropic a ensuite publié Claude Opus 5. Grâce à ce modèle, les chercheurs ont pu créer une faille de sécurité fonctionnelle du jour au lendemain.

Cela montre à quelle vitesse l'IA évolue. Une tâche qu'Opus 4.8 n'avait pas réussi à accomplir malgré plusieurs sessions a été résolue par Opus 5 quelques heures seulement après sa sortie.

Le deuxième aspect intéressant est que les chercheurs ont dû ruser pour que Claude les aide. Le modèle refusait de développer un exploit pour un système distant, car il considérait la requête comme contraire à l'éthique. Les chercheurs ont donc dû présenter la tâche comme un exercice de type « capture du drapeau » (une compétition de piratage) pour le convaincre de coopérer.

Une fois cela fait, l'agent a pris le contrôle du serveur du forum de test en quatre heures. Les chercheurs ont ensuite exploité cette faille contre le forum d'OpenAI. Cela démontre que, malgré les efforts des entreprises pour encadrer l'utilisation de leur IA sur le plan éthique, un chercheur ingénieux peut toujours la contourner grâce à une simple manipulation des requêtes.

Et cela n'a pas coûté cher. Hacktron a dépensé moins de 3 000 $ en jetons d'IA au cours de son projet de recherche de deux mois, qui a mobilisé trois chercheurs et a permis de découvrir des vulnérabilités affectant plusieurs grandes entreprises.

La faille de traitement d'images a servi de base à un projet plus vaste baptisé HEIF Heist . Hacktron a découvert des failles de sécurité similaires affectant les services et logiciels d'entreprises telles que Slack, Meta et GitHub. Adapter l'exploit HEIF pour cibler une nouvelle entreprise prenait en moyenne un ou deux jours.

Tout cela abaisse encore davantage le niveau d'exigence en matière de piratage sophistiqué. Depuis des années, on peut utiliser des outils de piratage prêts à l'emploi sans vraiment comprendre leur fonctionnement, mais il fallait une véritable expertise pour analyser un logiciel, trouver des failles cachées et les transformer en exploits fiables.

Hacktron précise que l'expertise humaine reste essentielle et qu'il ne s'agit pas d'un piratage entièrement autonome. Néanmoins, l'IA permet de rendre certaines de ces compétences plus accessibles et moins coûteuses, et ses performances ne cessent de s'améliorer.


Empêchez les menaces de faire du mal.

Malwarebytes Browser Guard Bloque automatiquement les pages d'hameçonnage et les sites malveillants. Gratuit, installation en un clic. Ajoutez-le à votre navigateur →

À propos de l'auteur

Danny Bradbury est journaliste spécialisé dans les technologies depuis 1989 et rédacteur indépendant depuis 1994. Il couvre un large éventail de sujets technologiques pour un public allant des consommateurs aux développeurs de logiciels et aux DSI. Il rédige également des articles pour de nombreux dirigeants d'entreprises du secteur technologique. Originaire du Royaume-Uni, il vit désormais dans l'ouest du Canada.