Le filigrane IA est une technologie peu fiable avec des « limitations importantes », a déclaré OpenAI.

OpenAI déploie le filigrane de texte dans l'UE dans sa dernière tentative de se conformer aux lois de la région sur l'IA après que le bloc a déclaré qu'il réglementerait ChatGPT selon ses règles les plus strictes pour les plateformes en ligne.

La société a déclaré qu'elle ajouterait un filigrane invisible au cours des prochaines semaines au texte généré à partir de ChatGPT et du Codex dans la région. Les clients API du monde entier seront également autorisés à opter pour le filigrane de texte pour certains modèles, tandis que certains chercheurs et experts auront accès pour tester le détecteur de filigrane.

La nouvelle fonctionnalité intervient après l'entrée en vigueur en août dernier des règles de transparence de la loi européenne sur l'IA, qui exigent que certains systèmes d'IA indiquent aux utilisateurs quand ils interagissent avec l'IA et comment le contenu qu'ils consomment est généré ou modifié par celle-ci.

La technologie de filigrane IA n’est pas entièrement fiable, les chercheurs, les entreprises d’IA et les législateurs sont tous d’accord. Mais les inquiétudes concernant l’impact des contenus manipulés sur la société incitent les régulateurs à faire pression en faveur d’une technologie de détection, quelle que soit sa précision à l’heure actuelle.

La technologie de filigrane de texte d'OpenAI, appelée TextGrain, ajoute un signal statistique invisible aux choix de mots du modèle, a indiqué la société. Le détecteur recherche ce signal pour évaluer si un passage contient un filigrane.

Bien que les passages plus courts et les sorties générées par l’IA et éditées par des humains soient difficiles à détecter, a précisé la société. Selon ses tests, les taux de détection chutent de près de 100 % lorsque les textes générés ne sont pas édités, à moins de 20 % lorsque seulement 25 % des mots sont modifiés.

« Le tatouage et la détection de texte restent des technologies précoces avec des limites importantes… (et) notre approche progressive reflète à la fois les exigences de la loi européenne sur l'IA ainsi que les limites de la technologie », a déclaré OpenAI.

Le créateur ChatGPT est l'un des 200 signataires du Code de bonnes pratiques de la loi sur la transparence du contenu généré par l'IA – un outil volontaire visant à aider les entreprises à se conformer aux lois radicales. Anthropic, le français Mistral, Meta et Microsoft sont également signataires.

OpenAI dispose déjà d'un certain nombre de mécanismes de vérification pour d'autres types de contenu. Les sorties image et audio prises en charge sont étiquetées avec les filigranes C2PA et SynthID.

Anthropic s'est engagé en août à commencer à filigraner le contenu dans l'UE. Selon la société, le texte généré à l'aide des modèles Claude lancés dans le bloc après le 2 août comporte désormais des filigranes intégrés, et les fichiers générés incluront les informations d'identification C2PA partout où ils sont pris en charge.

A lire également