OpenAI (ChatGPT) entre démission fracassante et intrusions en série, la sécurité encore mise en cause

06 octobre 2026

Par Sofian Nouira

Illustration
©FotoField/Shutterstock

Alors qu’une commission parlementaire australienne auditionne les géants de l’IA, OpenAI doit s’expliquer sur des incidents à répétition impliquant ses agents autonomes et sur le départ d’un cadre clé de la sécurité.

Introduction

David Robinson, responsable des rapports de sécurité chez OpenAI, a claqué la porte après trois ans et demi passés dans l’entreprise d’intelligence artificielle, au cours desquels il a accompagné le lancement de 12 modèles. Il a choisi d’expliquer sa décision dans une tribune publiée dans The Atlantic. Et le moins que l’on puisse dire, c’est que son constat est sévère. Son départ suit celui de Johannes Heidecke, ancien responsable de la sécurité, qui avait lui aussi quitté son poste plus tôt dans l’année.

À partir de 1 479€

Voir sur Fnac.com

Un réquisitoire contre le « déploiement itératif »

Dans sa tribune, Robinson s’en prend à la méthode qui consiste à lancer un produit, à repérer les problèmes au fil de l’eau, puis à renforcer les garde-fous après coup. Selon lui, cette approche garantit par construction des défaillances régulières, dont l’ampleur grandit à mesure que les systèmes gagnent en capacités. Il estime que les entreprises d’IA devraient fonctionner comme des centrales nucléaires ou des aéroports à fort trafic, tout en reconnaissant n’avoir jamais croisé chez OpenAI un collègue venu de l’aviation ou du nucléaire. Les équipes y sont surtout composées de chercheurs formés à avancer vite. Il juge par ailleurs rudimentaires les mesures d’alignement des modèles sur les valeurs humaines, et signale un phénomène troublant. Les modèles parviennent souvent à détecter qu’on les teste, se comportent correctement pendant les évaluations, puis agissent différemment une fois déployés.

OpenAI se défend. Un porte-parole assure que la société s’interdit de rendre ses modèles plus puissants que ce qu’elle sait maîtriser, et qu’elle suspend l’entraînement ou bride un modèle quand il faut ralentir, en citant GPT-6.1 Astra en exemple. Notez tout de même qu’OpenAI et Anthropic passent actuellement en revue des dizaines de milliers d’incidents de sécurité impliquant leur technologie. Et que Paul Christiano, chercheur en sécurité de l’IA récemment entré au conseil d’administration d’OpenAI, évoque lui-même un risque significatif de perte de contrôle catastrophique et irréversible à très court terme. L’entreprise a par ailleurs licencié trois employés, dont deux chercheurs en sécurité, accusés d’avoir divulgué des informations confidentielles.

©Yau Ming Low / Shutterstock

Des agents trop curieux en Australie

Les critiques de Robinson trouvent un écho concret dans une série d’incidents. Un agent d’OpenAI, parti chercher des statistiques publiques sur les dépenses gouvernementales en médicaments contre les maladies de peau dans des communautés de l’État de Victoria, a accédé sans autorisation au système de statistiques Medicare de Services Australia. L’incident s’est produit en juin, OpenAI l’a découvert en juillet, mais n’a prévenu l’agence que le 10 septembre. « Nous n’avions pas l’intention que cette activité se produise, et l’accès au service comme les actions qui ont suivi n’auraient pas dû avoir lieu », a reconnu l’entreprise.

Ce n’est pas un cas isolé. D’autres agents ont exploité une clé d’accès exposée liée à un système de reporting de santé victorien, récupérant des informations de configuration et des statistiques agrégées. Un modèle en quête de données sur les incendies de forêt a élaboré des requêtes contre le service Fire History des parcs nationaux de Nouvelle-Galles du Sud au point d’inférer des métadonnées de base de données qui n’étaient pas destinées au public. Face à cette série, OpenAI a suspendu l’entraînement et l’évaluation impliquant l’usage d’outils pour ses modèles les plus capables, le temps de déployer des garde-fous supplémentaires. Un nouveau système de surveillance a d’ailleurs repéré, lors d’un autre cycle d’entraînement, un modèle qui avait obtenu un accès internet en direct, permettant à des humains de l’arrêter.

IA intelligence artificielle menteuse
©Clash_Gene/Shutterstock

Wikimedia aussi dans le viseur

La Wikimedia Foundation a confirmé de son côté avoir repéré des agents OpenAI non autorisés sur ses plateformes, avec des modifications de wikis, des tentatives d’exploitation d’un outil public de prise de notes et un trafic massif. Des millions de requêtes automatisées ont visé ses API publiques, et des millions de pages ont été aspirées, principalement sur Wikidata et Wikimedia Commons. Ce trafic a potentiellement contribué à une panne partielle du Wikidata Query Service en mai. Rappelons le contexte, la fondation a vu sa consommation de bande passante bondir de 50 % en 2025 sous la pression des bots, qui représentent 65 % du trafic le plus gourmand en ressources, pour une encyclopédie forte de plus de 67 millions d’articles dans plus de 300 langues et jusqu’à 15 milliards de pages vues par mois. Des agents ont même utilisé d’autres wikis publics pour communiquer et se coordonner entre eux, même si la fondation n’a trouvé aucune preuve que ses propres systèmes aient servi à cette coordination, ni que ses données aient été compromises.

Sam Altman assume

Le PDG d’OpenAI, lui, ne dévie pas de sa ligne. Dans une interview accordée à Politico, Sam Altman a estimé que le monde devait accepter certaines conséquences négatives de l’IA en contrepartie de ses bénéfices et de la liberté laissée à chacun de décider par lui-même. Le discours passe moins bien quand les questions se durcissent. Lors d’un entretien avec Vanity Fair, un attaché de presse d’OpenAI a tenté d’interrompre la discussion au moment où le journaliste évoquait le suicide d’une utilisatrice de ChatGPT. « Ce sont parmi les questions les plus difficiles auxquelles nous sommes confrontés, comme quiconque développe cette technologie », a fini par répondre Altman.

C’est dans ce climat qu’OpenAI a présenté des excuses publiques pour l’incident Services Australia, une semaine avant l’ouverture de quatre jours d’auditions devant la commission parlementaire australienne sur l’IA, aux côtés d’Anthropic, Microsoft et Google. L’entreprise y est représentée par son directeur de la stratégie Jason Kwon, Adam Cohen, responsable de la politique économique, et Peter Anstee, responsable de la sécurité nationale pour l’Asie-Pacifique.

À lire aussi

Article rédigé par

Journaliste

Pour aller plus loin