Anthropic aurait annoncé à ses clients, dans un courriel daté du 24 septembre, l’ajout d’un filigrane textuel à Claude Fable 5, Claude Sonnet 5 et Claude Opus 4.8 à partir du 30 septembre 2026. Cette marque statistique est intégrée aux choix de mots : elle n’ajoute pas de caractères cachés au texte et une détection positive ne prouve pas que Claude en est l’auteur.
Trois modèles concernés par le calendrier rapporté
Les trois modèles cités dans l’annonce sont Claude Fable 5, Claude Sonnet 5 et Claude Opus 4.8. Le début de leur prise en charge est prévu le 30 septembre, selon le calendrier rapporté.
Au 26 septembre, la liste de prise en charge d’Anthropic mentionne déjà quatre modèles : Claude Fable 5.1, Claude Mythos 5.1, Claude Opus 5.5 et Claude Opus 5. Cette liste distingue les modèles que l’entreprise indique comme compatibles de ceux dont l’ajout est programmé.
Un motif dans les choix de mots, pas un caractère caché
Anthropic décrit son filigrane comme une version de SynthID-Text, une méthode qui crée un motif statistique en influençant le choix entre plusieurs mots ou éléments de texte plausibles. Le résultat reste imperceptible à la lecture : il n’y a ni balise visible, ni chaîne de caractères dissimulée dans le texte.
Retaper mot pour mot un passage ne change pas la séquence de choix lexicaux qui forme ce motif. Mais un texte court peut être difficile à détecter, et une réécriture importante, une paraphrase ou un mélange avec d’autres textes peut affaiblir le signal.
Le code constitue un cas particulier : Anthropic indique que le filigrane y est généralement moins présent lorsque les instructions imposent une sortie exacte. Il peut néanmoins concerner des choix plus libres, comme le texte des commentaires.
Ce qu’une détection peut établir
Selon Anthropic, un résultat positif signale que Claude a pu générer ou traiter le texte. Il ne permet pas, à lui seul, d’établir qui a fourni les idées, ni d’attribuer chaque phrase à Claude. Le filigrane ne contient pas d’information identifiant une personne, une organisation ou une conversation.
La détection de filigranes textuels est en aperçu privé pour les organisations éligibles et les entreprises ayant des obligations de conformité concernées. Elle n’est pas proposée comme détecteur public à tous les utilisateurs.
Les fichiers générés peuvent aussi comporter des C2PA Content Credentials, des métadonnées signées qui renseignent sur la provenance d’un fichier pris en charge. Ce mécanisme est distinct du motif statistique intégré au texte.