OpenAI a annoncé des changements dans ChatGPT pour se conformer à la loi sur l’IA de l’Union européenne. L’entreprise commencera à ajouter un filigrane invisible aux textes de ChatGPT et de Codex, après qu’Anthropic a annoncé un système similaire pour Claude il y a deux semaines.
Un signal invisible entre les mots que choisit ChatGPT
La clé réside dans textGrain, une technologie qui introduit un signal statistique dans le choix des mots du modèle, de sorte qu’il se transmet quand on copie et colle le texte. Selon OpenAI, le détecteur cherchera ensuite ce motif pour déterminer si un fragment contient la marque. Pour le lecteur, le texte gardera son aspect habituel à la lecture, mais il pourra être détecté.
Le déploiement sera progressif. ChatGPT et Codex intégreront la marque dans l’Union européenne au cours des prochaines semaines, tandis que, si nous utilisons l’API, nous pouvons déjà l’activer, volontairement sur la plupart des modèles. Cette décision, sans aucun doute, est particulièrement intéressant après des années de travail autour des détecteurs de texte généré par ChatGPT qui n’ont pas toujours fonctionné comme ils l’auraient dû.
Un détecteur qui dépend du contexte et qui s’accompagne de limites
Avec le nouveau système de marquage, OpenAI ouvrira l’accès à son détecteur aux chercheurs et aux organisations spécialisées. La précision, selon OpenAI, varie beaucoup selon la longueur et le type de contenu : dans des textes de 400 tokens, remplacer 10 % des mots par des synonymes fait passer la détection de 92 % à 66 %, tandis qu’avec 25 % de changements elle tombe à 17 %.
Nous sommes donc face à un outil de traçabilité plus qu’à une preuve absolue d’attribution. La marque indique qu’un système d’OpenAI a contribué au texte, tandis que l’identité de l’utilisateur, la propriété et le degré d’intervention humaine restent hors du champ de l’analyse.