List of Best

Anthropic ajoute des filigranes invisibles aux textes de Claude pour se conformer aux règles de l'EU AI Act

Sommaire
Official announcement image: Anthropic Adds Invisible Watermarks to Claude Text to Meet EU AI Act Rules
Source asset: \2.

Anthropic ajoute un filigrane invisible à tous les textes générés par les futurs modèles Claude. Si votre équipe utilise l’IA pour l’édition, l’éducation ou la tenue de registres réglementés, ce changement a un impact sur la manière dont vous suivez et prouvez l’utilisation de l’IA dans le cadre de l’AI Act de l’Union européenne.

Le 14 août 2026, l’entreprise a publié un guide technique intitulé Anthropic — How Claude’s text watermark works. Anthropic déploie cette fonctionnalité à l’échelle mondiale car elle ne peut pas encore la limiter facilement par région.

Comment fonctionne ce motif caché

Anthropic a conçu son système à partir de la méthode SynthID-Text de Google DeepMind. Le signal est totalement invisible. Il n’ajoute pas de caractères spéciaux, de tokens supplémentaires ou de balises visibles à votre contenu généré.

À la place, le modèle ajuste légèrement les calculs mathématiques qu’il utilise pour choisir les mots lorsque plusieurs options sont tout aussi pertinentes. Un outil de vérification utilise une clé secrète pour analyser ces choix subtils. Il calcule ensuite la probabilité que Claude ait contribué à la rédaction du texte.

Voici ce que cela implique :
Aucun coût supplémentaire. Anthropic indique que le filigrane n’ajoute aucun token supplémentaire et n’augmentera pas les tarifs d’utilisation.
Aucune donnée personnelle. Le filigrane ne contient aucune information sur les comptes d’utilisateurs, les organisations ou les discussions.
Une API de détection à venir. Anthropic prévoit de lancer prochainement une API de détection, bien que les détails définitifs restent à préciser.

Ce qu’affirme le fournisseur — et ce que personne n’a encore vérifié

Anthropic affirme que les tests internes n’ont montré aucune baisse réelle de la qualité d’écriture, en citant une étude distincte sur SynthID-Text. Gardez à l’esprit que ces affirmations proviennent directement des tests internes d’Anthropic et des recherches citées. Personne en dehors de l’entreprise n’a encore vérifié chaque modèle Claude, chaque langue ou chaque paramètre de température.

Les limites de la détection

Un résultat positif signifie seulement qu’il est probable que Claude ait été impliqué à un moment donné. Il ne peut pas prouver la paternité humaine. Il ne peut pas non plus différencier Claude d’une autre IA, ni déterminer si Claude a rédigé ou simplement corrigé le texte.

La détection devient beaucoup plus faible pour :
– Les courts extraits de texte
– Les tâches de programmation
– Les écrits purement factuels offrant peu d’alternatives dans le choix des mots
– La relecture légère et les réécritures complètes

Par ailleurs, le filigranage de texte est totalement distinct des métadonnées C2PA d’Anthropic utilisées pour les fichiers image.

Ce que vous devez faire ensuite

Ne vous fiez pas uniquement aux scores. Ne considérez jamais ce filigrane comme une preuve unique de plagiat ou de non-respect des règles.

Quand Anthropic publiera son API de détection, testez-la sur vos propres flux de travail. Générez des textes longs avec Claude, modifiez-les, traduisez-les et observez où le signal s’estompe. D’ici là, conservez des traces internes claires des prompts, des fichiers sources et des révisions humaines.

← Toute l'actualité