Intelligence artificielle · Actualité

OpenAI commencera à ajouter des filigranes invisibles aux textes générés par ChatGPT et Codex dans l'Union européenne.

OpenAI a annoncé qu’elle commencerait à insérer des filigranes invisibles dans les textes générés par ChatGPT et Codex pour les utilisateurs de l’Union européenne, en réponse aux règles de transparence du Règlement sur l’IA du bloc. Cette mesure s’appliquera dans les prochaines semaines à tous les plans du chatbot dans la région.

Fonctionnement de la filigrane invisible

La technologie s’appelle textGrain et ajoute un signal statistique imperceptible dans le choix des mots effectué par le modèle lors de la rédaction d’un texte. Un détecteur propre à OpenAI peut ensuite analyser un fragment et estimer s’il a été généré par ses systèmes.

L’entreprise a expliqué que les clients utilisant son interface de programmation (API) dans n’importe quel pays du monde peuvent activer cette filigrane de manière optionnelle pour certains modèles. La fonctionnalité reste désactivée par défaut et revient à chaque développeur de décider.

Pour l’instant, l’accès au détecteur n’est pas public. OpenAI a lancé un appel à candidatures pour que les chercheurs et les organisations spécialisées demandent l’autorisation d’utilisation, conformément au Code de pratiques de l’Union européenne sur la transparence du contenu généré par l’intelligence artificielle, que la société a signé en juin.

L’obligation légale derrière l’annonce

L’article 50 du Règlement sur l’IA de l’Union européenne exige aux entreprises offrant des systèmes d’intelligence artificielle générative de rendre leurs résultats identifiables de manière lisible par des machines. Cette obligation de transparence est entrée en vigueur de manière générale le 2 août.

OpenAI n’est pas la première à répondre à cette norme. Selon une reconstruction effectuée par le site spécialisé Tech Startups, Anthropic avait introduit des filigranes invisibles pour les modèles compatibles de Claude moins de deux mois auparavant, et avait choisi de les appliquer dans le monde entier dès le lancement car, selon les explications de cette entreprise, elle ne dispose pas encore d’une méthode stable pour les limiter à l’Europe uniquement.

OpenAI a choisi la voie inverse : restreindre le déploiement à l’Union européenne pour l’instant et le laisser comme option volontaire dans le reste du monde. « Nous ne faisons pas de la filigrane de texte un standard global par défaut lors de ce lancement », a indiqué l’entreprise dans son communiqué, selon lequel cette approche régionale lui permet d’apprendre de l’usage réel avant de l’étendre.

Les limites reconnues par l’entreprise elle-même

Un rapport technique publié le même jour, signé par des chercheurs d’OpenAI ainsi que par des universitaires de l’Université de Pennsylvanie et de l’Université Yale, détaille la méthode mathématique derrière textGrain et ses résultats en laboratoire.

Avec un taux de faux positifs fixé à seulement 1 %, le détecteur a identifié la marque dans environ 80 % des fragments de 200 mots évalués et près de 95 % des fragments de 400 mots, en utilisant comme test des textes de vulgarisation générale. Les performances chutent de manière marquée dans les contenus où les mots ont moins d'alternatives possibles, comme les textes mathématiques.

Le rapport lui-même admet que la marque se dégrade rapidement si le texte est modifié. En remplaçant 10 % des mots d'un fragment par des synonymes, la détection est passée d'environ 92 % à 66 % ; en remplaçant 25 %, elle est tombée à seulement 17 %. OpenAI a également précisé qu'une marque détectée ne permet pas d'identifier à quel utilisateur, compte ou conversation appartient le texte.

L'entreprise a indiqué n'avoir observé aucune différence pertinente de qualité dans les réponses de son modèle le plus récent, Astra, en comparant les versions avec et sans la marque activée, selon les tests internes qu'elle utilise habituellement pour l'évaluer.

OpenAI a annoncé qu'elle prévoit de publier davantage de détails techniques et de libérer éventuellement textGrain en tant qu'outil open source. L'entreprise proposait déjà auparavant une vérification publique de la provenance pour les images et l'audio via son site openai.com/verify et une interface de programmation dédiée, outils qui, selon l'entreprise, resteront disponibles sans changement.