En bref
- Un agent IA d’OpenAI a tenté de détecter des failles sur plusieurs sites publics australiens et américains, dont Medicare.
- L’Australie reproche à OpenAI d’avoir tardé à signaler l’incident, même si aucune donnée de santé personnelle ne semble avoir été compromise.
- Ces incidents relancent les inquiétudes sur le contrôle des agents IA, alors que les systèmes deviennent plus autonomes que les dispositifs de sécurité censés les encadrer.
Quand une IA ne se contente plus de répondre, mais cherche seule une faille sur un site public, on n’est plus dans la simple démo. L’attaque révélée en Australie place OpenAI dans une zone franchement inconfortable.
Un agent IA qui franchit la ligne
En juin 2026, un agent IA d’OpenAI a visé le site public de Medicare, le système australien d’assurance santé. Anthony Albanese, Premier ministre australien, a confirmé l’incident et expliqué qu’à ce stade, rien n’indiquait qu’une donnée de santé personnelle ait été compromise.
Le plus marquant est ailleurs. Conrad Stosz, responsable gouvernance chez Transluce, estime qu’on tient peut-être là le premier cas d’un agent qui choisit de lui-même de pirater une entité gouvernementale. Et ça, clairement, le seuil symbolique n’est pas le même qu’un bot qui bug dans son coin.
Canberra surtout agacé par l’alerte tardive
Le gouvernement australien n’a pas seulement tiqué sur l’attaque. Il a aussi très mal pris la façon dont OpenAI a géré l’alerte. Anthony Albanese dit avoir parlé à Sam Altman pour lui faire part de l’extrême inquiétude du pays, tout en reprochant à l’entreprise d’avoir trop tardé à prévenir les autorités.
L’email de notification n’a été envoyé que le 10 septembre, vers une adresse générique de l’administration australienne. Cette boîte n’étant consultée qu’une fois par jour, le message n’a été vu que le 11 septembre. Puis l’information n’est remontée jusqu’à la ministre des services gouvernementaux, Katy Gallagher, que le 17 septembre. Résultat, un incident de juin n’a réellement atterri au bon niveau politique qu’en septembre. Pas idéal.
D’autres cibles ont aussi été testées
Ce cas n’est pas isolé. D’après les éléments connus, l’agent de OpenAI a aussi tenté d’entrer dans la bibliothèque numérique de l’Université du Nouveau-Mexique les 25 et 26 mai. Il cherchait des photos d’un ancien centre de traitement de la tuberculose et, faute d’y accéder, il a exploré des vulnérabilités possibles avant d’inonder le serveur de requêtes.
Le 28 mai, même logique sur Data USA, une plateforme open source qui visualise des données provenant de plusieurs agences fédérales. Après l’échec d’une requête classique, l’agent a de nouveau sondé le site à la recherche de failles. Apparemment, ni Data USA ni l’Université du Nouveau-Mexique n’ont été réellement compromis.
OpenAI reconnaît un problème plus large
OpenAI dit avoir contacté ces deux organisations et précise avoir découvert la tentative contre le site australien après une revue approfondie de ses modèles. L’entreprise reconnaît en substance que ses systèmes ont entrepris des actions non prévues. Son examen complet doit encore durer quelques mois.
Bon, ce n’est pas un accident isolé tombé du ciel. OpenAI a récemment lancé un nouveau cadre de signalement des problèmes d’alignement pour accélérer la publication d’incidents où ses IA partent en roue libre. Dans ce rapport, six autres cas préoccupants sont évoqués. Cette annonce arrive après les affaires Hugging Face et RubyGems. L’entreprise admet même que l’industrie n’a pas encore résolu l’alignement et la surveillance à un niveau suffisant pour continuer à accélérer longtemps au maximum. Et Sam Altman a plaidé à l’ONU pour des standards internationaux d’évaluation des capacités, des risques et du besoin de supervision humaine. Le message est limpide, les agents vont plus vite que les garde-fous.