Astra inquiète OpenAI avant même sa sortie

OpenAI a suspendu une partie du développement d’Astra après une alerte interne. Le modèle aurait atteint un niveau jugé critique en cybersécurité.

OpenAI
Image d'illustration. OpenAI — OpenAI / PR-ADN

En bref

  • OpenAI met en pause Astra après avoir détecté des capacités cyber jugées critiques.
  • Le modèle pourrait mener certaines cyberattaques de façon autonome, selon les tests internes.
  • OpenAI renforce ses contrôles et poursuit les évaluations avant toute sortie publique.

Voir un labo d’IA lever le pied sur son propre modèle, avant même sa sortie, ce n’est pas banal. Et c’est précisément ce que vient de faire OpenAI avec Astra, un modèle encore en chantier, après avoir jugé que certaines de ses capacités posaient un vrai problème de sécurité.

Un aveu public qui sort du cadre habituel

Vendredi, OpenAI a expliqué avoir suspendu une partie du développement d’Astra. Motif, un examen interne a conclu que le modèle avait fait des progrès assez marqués en codage agentique et en cybersécurité pour justifier une alerte.

Le point intéressant, presque plus que la décision elle-même, c’est la publicité donnée à l’affaire. Des entreprises retardent des produits pour des raisons de sûreté ou de sécurité, bien sûr. Mais annoncer publiquement qu’un produit pas encore lancé est mis sur pause à cause de ses capacités, c’est rare. Très rare.

Pourquoi Astra a déclenché l’alarme ?

Selon OpenAI, Astra a atteint le critical cybersecurity threshold défini dans son Preparedness Framework, le cadre interne mis en place en 2023. En gros, le modèle serait capable d’identifier puis d’exécuter, de façon autonome, des cyberattaques contre des systèmes réels habituellement bien protégés.

L’entreprise dit continuer ses tests et ses mesures, mais ses premières évaluations sont déjà assez solides pour qu’elle n’écarte pas un niveau de capacité critique. Elle précise aussi qu’Astra n’a pas été impliqué dans l’exploitation de Hugging Face. Détail important, vu le contexte.

Le contexte pèse lourd chez OpenAI

Parce que oui, OpenAI arrive avec un passif récent. Un autre modèle, lui aussi non publié, avait réussi à compromettre les systèmes d’Hugging Face pendant des tests internes. Premier incident vérifiable où un labo d’IA perd le contrôle de son modèle. Clairement, ça marque.

Depuis, d’autres cas ont été révélés. Chez OpenAI, mais aussi chez Anthropic, des modèles ont franchi leur sandbox et posé des menaces pendant des évaluations cyber. Résultat, le débat s’est emballé. Certains experts et responsables politiques demandent un encadrement plus strict. D’autres y voient aussi, quand même, un signe de puissance technique assez spectaculaire.

Ce qui change concrètement maintenant

OpenAI dit partager ces informations au nom de la transparence vis-à-vis du public et des communautés liées à la sûreté et à la sécurité. Ce n’est pas qu’une note de blog pour cocher une case.

Le labo a renforcé ses contrôles de sécurité et mis en pause les activités internes autour d’Astra qui ne respectent pas ces nouvelles barrières. Il travaille aussi avec des agences gouvernementales concernées, ainsi qu’avec des organisations sélectionnées dans la sécurité de l’IA, pour tester davantage le modèle. Ce qui compte, au fond, c’est simple, Astra n’est toujours pas sorti, mais il force déjà tout le monde à revoir les règles du jeu.

Jordan Servan

Spécialiste Tech

Rédacteur sur Begeek.fr depuis 2014, passionné par les jeux vidéo, les séries TV et le cinéma.

X LinkedIn Tous ses articles →
Une erreur dans cet article ?

Nous apportons le plus grand soin à chaque article et nous appuyons sur des sources fiables. Personne n'est à l'abri d'une erreur : si vous en repérez une, signalez-la, nous la corrigerons au plus vite.

Sujets
Intelligence artificielle OpenAI Sécurité

Lisez Begeek en priorité sur Google

Ajoutez-nous à vos sources préférées : nos articles remonteront plus haut dans votre actualité.

Ajouter à mes sources

À découvrir

La suite, sélectionnée pour vous.

Begeek · 09 Août · 8h00

Test MOVA LR10 Prime : la litière connectée qui nous fait presque oublier la corvée

Nettoyer la litière fait rarement partie des meilleurs moments lorsqu'on partage son quotidien avec un chat. Avec la LR10 Prime, MOVA reprend une recette déjà éprouvée ailleurs : automatiser le ramassage tout en profitant de capteurs pour suivre les habitudes de son animal. À 499 euros, la promesse est forcément ambitieuse. Après quelques semaines, difficile pourtant de nier le confort apporté par la machine, même si cette tranquillité a encore quelques limites, notamment du côté des odeurs.