OpenAI va commencer à ajouter un filigrane invisible à certains textes générés par ChatGPT et Codex dans l'Union européenne. Le déploiement doit commencer progressivement au cours des prochaines semaines afin de répondre aux nouvelles obligations de transparence prévues par l'AI Act européen.
Contrairement à ce que le terme « filigrane » pourrait laisser penser, aucun caractère caché, espace invisible ou code secret ne sera ajouté au texte. La technologie développée par OpenAI, baptisée textGrain, agit directement sur la manière dont le modèle choisit ses mots.
Lorsqu'une intelligence artificielle rédige une phrase, plusieurs mots ou formulations sont souvent possibles. textGrain modifie légèrement les probabilités utilisées pour effectuer ces choix afin de créer, sur l'ensemble d'un texte suffisamment long, une sorte de signature statistique invisible. Un outil spécialement conçu peut ensuite rechercher ce motif et déterminer si le texte présente les caractéristiques d'un contenu généré par OpenAI.
Cette méthode n'est toutefois pas infaillible. Les textes courts sont plus difficiles à identifier et une réécriture importante, une paraphrase ou une traduction peut affaiblir, voire faire disparaître le signal. L'absence de filigrane détecté ne permettra donc pas d'affirmer qu'un texte a forcément été écrit par un humain.
OpenAI insiste également sur un autre point : le filigrane ne permet pas d'identifier l'utilisateur qui a généré le texte, son compte, sa conversation ou le prompt utilisé. Il indique uniquement qu'un système OpenAI a probablement participé à la génération ou au traitement du contenu.
Au lancement, l'outil permettant de détecter textGrain ne sera d'ailleurs pas accessible librement au public. OpenAI prévoit dans un premier temps de le réserver à certains chercheurs et organismes spécialisés afin d'évaluer sa fiabilité et de limiter les mauvaises interprétations liées aux faux positifs ou aux textes modifiés.
Le filigranage sera progressivement activé pour les textes éligibles générés avec ChatGPT et Codex dans l'Union européenne. Les utilisateurs de l'API OpenAI peuvent de leur côté activer volontairement cette fonction dès aujourd'hui sur certains modèles, mais elle reste désactivée par défaut en dehors de ce cadre.
Commentaires
Aucun commentaire pour le moment.