OpenAI a annoncé le 5 octobre un dispositif de provenance des textes baptisé textGrain. L’entreprise prévoit de l’activer progressivement, au cours des prochaines semaines, pour les sorties éligibles de ChatGPT et Codex dans l’Union européenne. Dans l’API, l’option est proposée mondialement sur certains modèles, avec une activation volontaire et désactivée par défaut.
Une marque dans les choix de mots
Il ne s’agit pas d’un logo visible collé à chaque réponse. Le système introduit un signal statistique dans les choix effectués pendant la génération. Le texte reste lisible normalement, tandis qu’un détecteur adapté peut rechercher la présence de ce signal.
Le rapport technique explique que la méthode ajuste le marquage à la marge de choix disponible lors de la production du texte. Lorsque plusieurs formulations sont possibles, certains choix peuvent être favorisés selon une règle contrôlée. La détection repose alors sur l’accumulation d’indices dans le passage examiné, plutôt que sur un mot qui prouverait à lui seul une origine artificielle.
OpenAI prévoit d’abord un accès au détecteur pour des chercheurs et des organisations approuvés. L’annonce ne correspond donc pas à la mise à disposition immédiate d’un outil universel permettant à chacun de vérifier n’importe quel texte.
La provenance ne garantit pas la vérité
Les textes courts ou fortement transformés posent des difficultés. Des réécritures ou des traductions peuvent atténuer le signal. Son absence ne prouve pas qu’un humain a tout rédigé ; sa présence ne permet pas non plus de mesurer précisément la contribution humaine à un document remanié.
Le contexte européen est celui des obligations de transparence de l’AI Act. La Commission européenne indique que l’article 50, applicable depuis le 2 août 2026, prévoit notamment des marques lisibles par machine pour certains contenus générés ou manipulés par IA. Les obligations varient selon le rôle du fournisseur ou de l’utilisateur professionnel et selon le contenu concerné.
Ce marquage peut ainsi apporter un indice de provenance. Il ne vérifie pas les faits, n’identifie pas une personne et ne dispense pas d’un contrôle éditorial. Les performances annoncées devront également être distinguées des résultats observés dans les usages réels.



