OpenAI va ajouter un filigrane invisible au texte ChatGPT et Codex dans l'UE pour se conformer à la loi sur l'IA


Photo de Sam Altman, PDG d'OpenAI.

-Andrej Sokolow/dpa

MADRID, 6 octobre (Portaltic/EP) –

OpenAI a annoncé son intention de remplir une partie du nouvelles lignes directrices en matière de transparence de l'intelligence artificielle (IA) de l'Union européenne, qui exigent que le texte généré soit identifiable, dans ce cas grâce à un filigrane invisible à la fois dans ChatGPT et dans le Codex.

Le laboratoire d'IA a donné les détails du système textGrain, qui introduit un signal statistique invisible dans les sélections de mots du modèle, qui sont ensuite détectées par son propre système, qui recherche ce signal pour évaluer si un fragment de texte contient le filigrane OpenAI.

Dans le cadre d'un déploiement progressif, et d'abord pour les utilisateurs mondiaux de l'API, ils pourront à partir de ce mardi choisir d'activer le filigrane sur certains modèles, qui « restera désactivé par défaut dans l'API ».

Pour les utilisateurs de l'Union européenne de ChatGPT et du Codex, dans les semaines à venir, le filigrane invisible sera ajouté au texte et au code générés sur les deux plateformes.

« Le texte en filigrane et sa détection restent comme des technologies naissantes avec des limites importanteset les opinions sur ses avantages et ses utilisations responsables continuent d'évoluer », note OpenAI dans son communiqué, avant de rappeler que son « approche progressive reflète à la fois les exigences de la loi européenne sur l'IA et les limites de la technologie, en mettant l'accent sur la transparence sur ce qu'un filigrane de texte peut et ne peut pas dire aux gens ».

De plus, le laboratoire d'IA a ouvert des candidatures d'accéder au détecteur de filigrane de texte, dont l'accès sera dans un premier temps limité aux chercheurs et organismes experts agréés.

D'autre part, OpenAI a publié un rapport plus complet décrivant le fonctionnement de textGrain. « Dans nos évaluations, textGrain a égalé ou surpassé d'autres approches testées, y compris SynthID pour le texte. Néanmoins, des performances élevées dans des conditions idéales ne garantissent pas que la détection sera fiable dans une utilisation quotidienne », note OpenAI.

Comme Anthropic l'avait fait en août en annonçant le déploiement de son filigrane invisible dans le texte généré par Claude et son API, déjà active dans Opus 5.5 et Sonnet 5.5, OpenAI a prévenu que « les détecteurs peuvent faire deux types d'erreurs : ils peuvent indiquer un filigrane là où il n'y en a pas – un faux positif – ou ignorer un filigrane présent – un faux négatif ».

Les difficultés techniques auxquelles textGrain est encore confronté sont détecter le filigrane dans des textes courts ou techniquescar il y a peu de place pour choisir les mots, et dans les textes édités, car l'édition réduit considérablement leur détection. Par exemple, remplacer 25 % des mots par des synonymes réduit la détection de 92 % à 17 % dans des fragments de 400 « jetons ».