En bref
- OpenAI marque invisiblement les textes de ChatGPT et de Codex dans l’UE
- En cause: la loi européenne sur l’IA, en vigueur depuis le 2 août 2026
- Son concurrent Anthropic marque déjà les textes de Claude dans le monde entier
Un texte rédigé par ChatGPT ressemble à n'importe quel autre. Il ne contient ni symbole particulier ni caractère caché. Pourtant, un logiciel devrait bientôt être en mesure de déterminer qu'il a été produit par une machine.
OpenAI a annoncé lundi soir qu'elle doterait désormais d'un filigrane invisible les textes générés par ChatGPT et par Codex, son outil de programmation. Le dispositif sera déployé dans les prochaines semaines pour toutes les utilisatrices et tous les utilisateurs, mais uniquement dans l'Union européenne, précise l'entreprise. Autrement dit: pas en Suisse.
Comment fonctionne le filigrane
Les chatbots comme ChatGPT reposent sur des modèles de langage (LLM). Entraînés sur d'immenses quantités de textes, ceux-ci ont appris à prédire quel mot a le plus de chances d'en suivre un autre, et ils construisent leurs réponses mot après mot. Souvent, plusieurs termes conviennent à peu près aussi bien.
Prenons un exemple, après le début de phrase: «Le train avait plus de 20 minutes de retard, les pendulaires étaient…». «Agacés» et «irrités» sont sans doute presque aussi probables l'un que l'autre, alors qu'«enthousiastes» l'est un peu moins. En temps normal, le choix entre eux relève du hasard, un peu comme un lancer de dés.
Avec le filigrane invisible qu'OpenAI s'apprête à introduire, ce dé sera en quelque sorte pipé. Une clé secrète déterminera quels mots sont favorisés, et à quels endroits. Un «agacés» isolé ne trahit rien. Mais sur plusieurs centaines de mots, le modèle opte étonnamment souvent pour les variantes favorisées. Un programme de vérification dédié pourra alors repérer ce motif, à condition de disposer de la clé.
La méthode s'appelle Textgrain, et elle a ses limites, ce qu'OpenAI reconnaît elle-même. Par exemple, remplacer un mot sur dix par un synonyme fait chuter le taux de détection de 92% à 66%. En remplacer un sur quatre le fait même passer sous la barre des 20%. Les textes courts, les réponses mathématiques et les traductions passent par ailleurs entre les mailles du filet.
Pourquoi OpenAI fait-il cela?
OpenAI ne fait pas ce geste de son plein gré: l'entreprise californienne y est contrainte par l'Union européenne. Depuis le 2 août, les obligations de transparence prévues par le règlement européen sur l'intelligence artificielle (AI Act) sont en vigueur. Les fournisseurs doivent désormais marquer les contenus générés par l'IA de façon que d'autres systèmes puissent les détecter.
Son concurrent, Anthropic, est déjà plus avancé
Anthropic a, de son côté, annoncé début août qu'elle doterait l'ensemble de ses modèles Claude d'un filigrane. Les premiers modèles qui en sont équipés sont déjà disponibles, et les plus anciens devraient suivre dans les prochains mois. Contrairement à OpenAI, Anthropic l'applique dans le monde entier, Suisse comprise. La raison est pourtant la même: le règlement européen.
Malgré ce nouveau filigrane, il n'est pas encore possible pour tout un chacun de soumettre n'importe quel texte à un test de détection. OpenAI réserve en effet pour l'instant son outil de vérification à certains publics. Il serait encore trop peu fiable pour le grand public, explique l'entreprise dans son communiqué.
Chez Anthropic, les autorités, les médias et les factcheckers peuvent demander un accès. Les détecteurs d'IA accessibles en ligne, eux, ne disposent pas des clés secrètes. Il n'existe pas non plus de norme commune: l'outil d'OpenAI ne reconnaît que les textes d'OpenAI. Impossible, donc, de passer simplement au crible un courriel étrangement lisse reçu dans sa boîte de réception. Et l'absence de filigrane ne prouve pas pour autant qu'il a été écrit par un humain.