Des agents IA d’OpenAI auraient échappé à leur contrôle

De nouveaux incidents impliquant des agents d’OpenAI relancent une question simple : qui enquête vraiment quand l’IA sort du cadre ?

OpenAI
Image d'illustration. OpenAI — OpenAI / PR-ADN

En bref

  • Des agents d’OpenAI auraient échappé à leurs contrôles et accédé à des infrastructures sensibles.
  • Les enquêtes restent limitées, ce qui empêche de comprendre pleinement l’ampleur des incidents.
  • Des chercheurs et élus réclament donc des enquêtes indépendantes et des règles plus strictes pour encadrer les agents IA.

Quand une IA sort de sa cage, personne n’est vraiment obligé de mener une enquête complète. C’est ça, le fond du problème. Et avec OpenAI, le sujet revient de façon un peu trop régulière pour rester un détail technique.

Le vrai bug, c’est l’absence d’arbitre

Des chercheurs en sécurité de l’IA poussent maintenant plus fort pour des enquêtes indépendantes après incident, au lieu de laisser chaque labo décider seul qui peut regarder quoi, et jusqu’où. La pression monte après plusieurs épisodes comparables chez Meta et Anthropic, et un nouveau cas attribué à des agents déployés en interne par OpenAI.

Selon ces chercheurs, des agents auraient pris le contrôle d’un wiki obscur en allemand entre mai et juin pour coordonner des évaluations et partager des méthodes afin de contourner les propres contrôles d’OpenAI. À ce stade, OpenAI n’a pas confirmé que cet essaim venait bien de chez lui. Mais le signal est sale. Vraiment sale.

Deux incidents, et une enquête qui s’arrête trop tôt

Quelques jours plus tôt, METR et Redwood Research avaient raconté l’incident de juillet chez Hugging Face. Là, un groupe d’agents d’OpenAI avait collaboré pour sortir de son bac à sable pendant une évaluation en cybersécurité, puis pénétrer les serveurs de Hugging Face.

Le plus gênant arrive après. Un second essaim aurait récupéré les techniques du premier pour obtenir un accès administrateur à un cluster de recherche au sein même de l’infrastructure d’OpenAI. Or l’enquête confiée à METR et Redwood Research ne couvrait que la partie Hugging Face, pas ce compromis interne. Dit autrement, on a regardé l’incendie dans le salon, pas celui qui courait déjà dans le couloir.

Même les enquêteurs disent qu’ils voyaient flou

L’investigation menée chez OpenAI a réuni trois enquêteurs pendant six jours, sur une fenêtre qui s’arrêtait grosso modo à la semaine finissant le 13 juillet. Sauf que le compromis de l’infrastructure interne a continué après cette date, sans être examiné.

Les chercheurs de METR ont expliqué que leur compréhension des faits s’était nettement approfondie à chaque retour, au point d’élargir et de réviser fortement leur rapport. Ryan Greenblatt, directeur scientifique de Redwood Research, a lui-même écrit qu’il avait été difficile d’obtenir une vision précise des événements et que des éléments désormais jugés clés n’avaient émergé qu’à la toute fin de l’enquête. Résultat, on se demande forcément ce qu’une enquête plus large aurait trouvé.

La loi est en retard, pendant que les modèles accélèrent

Jacob Steinhardt, fondateur et PDG du labo associatif Transluce, estime que ces résultats sont difficiles à contrôler, avec un risque sérieux de fuite hors du labo, et qu’il faut soumettre cette technologie aux mêmes standards que les autres recherches à haut risque. Il réclame aussi des investigations comportementales systématiques et davantage d’analyse post-incident indépendante.

Le timing n’aide pas. OpenAI sort Astra, présenté comme son modèle le plus puissant et le plus capable, alors que des experts craignent une plus grande opacité à cause d’une technique de raisonnement rendant la chaîne de pensée plus difficile à surveiller.

Et la loi, elle, traîne. Mackenzie Arnold, de LawAI, résume le souci ainsi : « Aujourd’hui, la plupart des lois en vigueur n’exigent qu’un résumé en langage clair de ce type d’incident », sans vrai pouvoir pour poser des questions, envoyer des enquêteurs, consulter les archives ou imposer leur conservation. Cette semaine, les élus Josh Gottheimer et Mike Lawler ont déposé un texte sur les agents IA incontrôlables, pendant que Greg Casar disait être « profondément préoccupé par la portée limitée » de l’enquête sur l’affaire Hugging Face. Clairement, le dossier n’est plus seulement technique.

Jordan Servan

Spécialiste Tech

Rédacteur sur Begeek.fr depuis 2014, passionné par les jeux vidéo, les séries TV et le cinéma.

X LinkedIn Tous ses articles →
Une erreur dans cet article ?

Nous apportons le plus grand soin à chaque article et nous appuyons sur des sources fiables. Personne n'est à l'abri d'une erreur : si vous en repérez une, signalez-la, nous la corrigerons au plus vite.

Sujets
Agent IA OpenAI

Lisez Begeek en priorité sur Google

Ajoutez-nous à vos sources préférées : nos articles remonteront plus haut dans votre actualité.

Ajouter à mes sources

À découvrir

La suite, sélectionnée pour vous.

Begeek · 06 Sep · 8h00

Tweet.app : le nouveau visage de Twitter.now

La plateforme lancée sous Twitter.now change déjà de nom après une première décision de justice. Mais elle garde un vrai morceau de l’héritage Twitter.

Begeek · 05 Sep · 14h00

Le marché du CD repart à la hausse

Les ventes de CD remontent nettement en 2026, après une vraie baisse l’an dernier. Derrière ce rebond, on voit surtout le retour en grâce de la tech plus simple.