Contexte réglementaire
Le 2 août 2024, le Règlement européen sur l’IA (EU AI Act) a imposé aux fournisseurs d’IA de marquer tout contenu généré afin qu’il soit détectable par d’autres systèmes. OpenAI a annoncé le 5 octobre 2026 que, pour se conformer à ces exigences, il déploiera un watermark invisible sur les réponses de ChatGPT et de Codex destinées aux utilisateurs situés dans l’Union européenne. La mise en œuvre débute dans les semaines qui suivent et concerne tous les plans d’abonnement, mais uniquement pour les comptes EU.
Mécanisme du watermark
Le watermark, nommé textGrain dans le rapport technique publié conjointement avec l’Université de Pennsylvanie et Yale, ne repose pas sur un symbole visible. Il modifie subtilement les probabilités de prédiction du modèle en appliquant un secret key qui trie les mots suivants. Chaque choix de mot reçoit un léger « nudging » qui, accumulé sur des centaines de tokens, crée un motif statistique détectable par un algorithme dédié. Ce motif persiste même après copie‑collage, car il est intégré dans la séquence de mots elle‑même.
Évaluation des performances et limites
OpenAI indique que l’activation du watermark n’a entraîné aucune dégradation mesurable du modèle, les scores de benchmark restant identiques aux versions non marquées. Cependant, les tests internes montrent que la détection chute de 92 % à 66 % lorsqu’environ 10 % des mots sont remplacés par des synonymes, ce qui indique une sensibilité aux ré‑écritures. De plus, les passages très courts, les réponses mathématiques et les textes traduits restent difficilement identifiables, car le nombre de tokens disponibles pour le motif est insuffisant. Le dispositif ne révèle pas l’identité de l’utilisateur qui a généré le texte, limitant ainsi les risques de traçage individuel.
Implications et perspectives
Le watermarking d’OpenAI s’inscrit dans une vague d’engagements de grandes entreprises (Anthropic, Google, Meta, Microsoft) à suivre le code de pratique européen sur le contenu IA. Contrairement à Anthropic, qui a appliqué son watermark à l’échelle mondiale, OpenAI ne l’active pas par défaut et le rend disponible via l’API uniquement sur demande. Cette approche reflète les craintes exprimées en 2024 selon lesquelles un watermark obligatoire aurait pu pousser les utilisateurs vers des concurrents non marqués. En limitant l’accès au détecteur aux chercheurs et organisations approuvées, OpenAI cherche à contrôler les évaluations de fiabilité tout en évitant une perception publique d’une preuve de non‑humanité. Le futur du watermark dépendra de l’efficacité des contournements et de l’évolution des exigences légales, notamment si l’UE élargit les critères de détection aux contenus fortement édités.