Vous avez utilisé Claude pour rédiger un texte ? Désormais, tout le monde le saura

Anthropic intègre des filigranes cachés dans les contenus générés par ses modèles. Ce nouveau système de marquage vise à garantir la transparence conformément à la législation européenne sur l'IA.

GeektimeAuteur : Yaniv Avital
Source
Vous avez utilisé Claude pour rédiger un texte ? Désormais, tout le monde le saura
Photo : Geektime / תמונה: Dreamstime

Lorsque vous souhaitez savoir aujourd'hui si un texte a été rédigé par un humain ou par un chatbot, vous pouvez chercher des caractères spéciaux comme le tiret long ou des motifs répétitifs. Vous pourriez également tenter votre chance avec des moteurs de détection, mais ils sont souvent peu fiables, confondant fréquemment les textes humains et les textes générés par IA. Désormais, Anthropic simplifie cette tâche en vous informant à l'avance qu'un contenu est généré par une IA.

À la suite de l'Europe

Suite aux exigences de transparence de la nouvelle loi sur l'intelligence artificielle en Europe, le développeur de Claude a annoncé lundi qu'il intégrerait des mécanismes de détection dans tout le contenu généré par ses modèles, sous forme de « filigranes » cachés. Ce changement sera appliqué à chaque nouveau modèle et outil publié à partir du mois d'août prochain, dans toute la gamme de produits de l'entreprise : de l'interface de chat Claude aux outils Claude Code et Claude Cowork, en passant par les API et les environnements de développement.

La mise en œuvre d'Anthropic repose sur deux technologies complémentaires. Dans les textes, le système injectera une couche de filigranes invisibles à l'œil nu. Selon l'entreprise, ce marquage ne nuit pas à la lisibilité et peut survivre au copier-coller vers d'autres plateformes, ainsi qu'à une édition légère. Pour les fichiers image (JPG, PNG ou SVG vectoriel), l'entreprise joindra des métadonnées vérifiées numériquement selon la norme ouverte C2PA, permettant de confirmer l'origine IA du fichier et de détecter les tentatives de modification.

Pas 100%

Cependant, Anthropic admet que ce mécanisme ne garantit pas une réussite totale. Le système pourrait signaler un texte comme généré par IA même si vous n'avez utilisé Claude que pour relire ou traduire un texte que vous avez écrit vous-même.

Par ailleurs, l'entreprise souligne plusieurs cas où le texte ne sera pas marqué :

  1. Les textes écrits par d'anciens modèles antérieurs à la nouvelle norme.

  2. Les textes ayant subi une réécriture massive, une traduction ou intégrés dans un texte humain.

  3. Les paragraphes extrêmement courts.

  4. Les fichiers dont le marquage numérique a été supprimé suite à une conversion de format, une combinaison avec des captures d'écran ou un nouvel enregistrement.

Dans la même rubrique