En bref
- L’Europe impose aux IA de rendre leurs contenus générés détectables par machine, poussant OpenAI à ajouter un filigrane invisible.
- OpenAI mise sur textGrain, mais reconnaît des limites sur les textes courts, les maths et les contenus modifiés.
- Le marquage sera surtout activé dans l’UE, tandis que l’accès au détecteur restera d’abord réservé à des chercheurs et organisations agréés.
Le vrai sujet, ce n’est pas juste un bouton de plus chez OpenAI. C’est l’Europe qui oblige les IA génératives à rendre leurs sorties reconnaissables par une machine. Du coup, OpenAI va bientôt ajouter un filigrane invisible aux textes et au code produits dans l’Union européenne.
L’Europe force enfin le marquage
Cette décision colle à l’article 50 du AI Act, qui impose aux fournisseurs d’IA générative de rendre les contenus textuels identifiables dans un format lisible par une machine. La règle vaut déjà pour les nouveaux entrants. Pour les acteurs déjà installés, la date limite tombe le 2 décembre.
Et ça dépasse largement OpenAI. Anthropic a déjà bougé plus tôt cette année, et la contrainte concerne aussi des groupes comme Microsoft, Google ou Meta. Sur ce point, l’UE ne laisse plus trop de place au flou.
TextGrain, la techno derrière le filigrane
Pour faire ça, OpenAI utilise un système propriétaire baptisé textGrain. L’idée est simple sur le papier : le modèle glisse un signal statistique invisible dans ses choix de mots. Ensuite, un détecteur peut repérer ce signal et déterminer si le contenu porte bien ce marquage.
L’entreprise assure que cette méthode a égalé, voire dépassé, d’autres approches du même genre, notamment SynthID pour le texte. Bon, elle ajoute aussi que de bonnes perfs dans des conditions idéales ne garantissent pas une détection fiable au quotidien. Traduction, ça peut marcher très bien en labo et beaucoup moins bien dans la vraie vie. Pas exactement un détail.
Ça marche, sauf quand ça compte vraiment
Les limites admises par OpenAI sont assez claires. Les textes courts sont plus difficiles à détecter, avec un taux de réussite d’environ 80%. Même problème pour certains contenus, en particulier les mathématiques. Et si un texte est retouché, le taux de détection baisse aussi.
Il y a quand même une ouverture intéressante : la technologie doit être publiée en open source pour que d’autres puissent la modifier. C’est potentiellement utile, parce qu’en l’état, le système ressemble encore à un outil prometteur plus qu’à une solution blindée.
Activation ciblée, accès verrouillé
Le filigrane ne sera pas activé par défaut partout. L’exception, ce sont les sorties éligibles de ChatGPT et de Codex dans l’UE, où il sera bien présent. Ailleurs, des clients pourront l’activer sur certains modèles, sans que OpenAI précise lesquels seront proposés au grand public mondial.
Côté détection, OpenAI avance avec plus de prudence. L’accès sera d’abord réservé à des chercheurs approuvés et à des organisations expertes. Et le détecteur ne remonte ni l’identité d’un utilisateur, ni ses prompts, ni ses conversations. En gros, l’objectif est de marquer le contenu, pas de pister les gens.