
Anthropic hat bekannt gegeben, dass Claude-Modelle, die ab dem 2. August 2026 veröffentlicht wurden, generierten Text automatisch mit einem maschinenlesbaren Wasserzeichen versehen. Für Bilder, SVGs und andere Dateiformate nutzt Anthropic stattdessen kryptografisch signierte C2PA-Provenienzdaten, die belegen, dass eine Datei von Claude erstellt oder bearbeitet wurde.
Wie funktioniert das Claude-Wasserzeichen?
Sprachmodelle erzeugen Texte, indem sie fortlaufend entscheiden, welches Wort als Nächstes plausibel folgt. An vielen dieser Stellen gibt es mehrere gleich gute Optionen. Genau hier setzt das Wasserzeichen an: Es verändert die Zufallsquelle, die Claude für diese Entscheidungen nutzt, und hinterlässt so ein Muster im Text. Für Lesende ist dieses Muster nicht wahrnehmbar, für Anthropic mit dem passenden Schlüssel aber nachweisbar.
Technisch basiert der Ansatz auf SynthID-Text, einem Wasserzeichen-Verfahren, das Google DeepMind 2024 entwickelt hat. Anthropic betont, dass die Methode keinen Einfluss auf die Qualität oder Kreativität der Texte hat: In einem kontrollierten Test empfanden menschliche Bewertende beim direkten Vergleich keinen Unterschied zwischen Texten mit und ohne Wasserzeichen. Anthropic hat eine Detection-API, mit der sich Texte künftig eigenständig auf das Wasserzeichen prüfen lassen, angekündigt, aber noch nicht veröffentlicht.
Bei Fakten oder Code greift das Verfahren kaum: Wo es nur eine richtige Antwort gibt, etwa bei einer Rechenaufgabe oder einem funktionierenden Code-Snippet, bleibt kein Spielraum für die zufällige Wortwahl, auf der das Wasserzeichen beruht. Auch reines Korrekturlesen menschlicher Texte hinterlässt oft zu wenige von Claude gewählte Wörter, um zuverlässig nachweisbar zu sein.
Wichtig für die Praxis: Eine leichte Überarbeitung entfernt das Wasserzeichen wahrscheinlich nicht vollständig. Erst wenn ein Text vollständig neu formuliert wird, verschwindet die Markierung zuverlässig. Dann stellt sich laut Anthropic aber auch die Frage, ob der Inhalt überhaupt noch als KI-generiert gilt.
Welche Claude-Produkte sind vom Wasserzeichen betroffen?
Die Markierung gilt laut Anthropic weltweit und über alle aktuellen Claude-Oberflächen hinweg: Claude Platform (API), Claude.ai, Claude Code, Claude Cowork und Claude Tag sind eingeschlossen. Auch Übersetzungen, die Claude erstellt, tragen ein Wasserzeichen, da hierbei jedes Wort neu von Claude gewählt wird.
Rollout bei älteren Modellen: Modelle, die vor dem 2. August 2026 veröffentlicht wurden, erhalten die Funktion schrittweise nachgerüstet. Einen festen Zeitplan dafür gibt es bislang nicht.
Der Zusammenhang mit dem AI Act
Auslöser der Maßnahme ist Artikel 50 des EU AI Act, dessen Kennzeichnungspflichten seit dem 2. August 2026 gelten. Anthropic hat im Juli 2026 den freiwilligen EU Code of Practice on Transparency of AI-Generated Content unterzeichnet, der Unternehmen einen rechtssicheren Weg bietet, die gesetzlichen Vorgaben nachweisbar zu erfüllen. Laut der EU-Kommission haben bis Ende Juli 2026 rund 190 Organisationen den Code unterzeichnet, darunter neben Anthropic auch OpenAI, Google, Meta, Microsoft und Mistral. Etwa die Hälfte der Unterzeichnenden sind kleine und junge Unternehmen, was laut Kommission zeigt, wie dynamisch die KI-Branche bei diesem Thema mitzieht.
Damit reiht sich das Claude-Wasserzeichen in die Regeln ein, die wir bereits in unserem Beitrag zur KI-Kennzeichnungspflicht ab August eingeordnet haben: Dort ging es um die sichtbare Kennzeichnungspflicht für Unternehmen, die KI-Inhalte veröffentlichen. Das Wasserzeichen von Anthropic setzt eine Ebene früher an, bei der technischen, maschinenlesbaren Markierung durch den Modellanbieter selbst.
Unsere Einordnung
Für Unternehmen, die mit Claude arbeiten, ändert sich im Arbeitsalltag zunächst nichts sichtbar, denn die Kennzeichnung läuft unbemerkt im Hintergrund und ersetzt nicht die im AI Act vorgesehene sichtbare Kennzeichnung gegenüber dem Publikum, die wir in unserem vorherigen Beitrag beschrieben haben. Beide Ebenen greifen ineinander: Die technische Markierung macht KI-Inhalte grundsätzlich nachweisbar, die sichtbare Kennzeichnung bleibt in den vom AI Act erfassten Fällen weiterhin Aufgabe der Unternehmen selbst.
Bemerkenswert ist, dass Anthropic die Wasserzeichen global und nicht nur für EU-Nutzerinnen und -Nutzer einführt, was ein Hinweis darauf sein kann, dass sich regulatorische Vorgaben aus der EU zunehmend als De-facto-Standard für die gesamte Branche durchsetzen. Wer als Unternehmen ohnehin schon Prozesse zur Einordnung von KI-Inhalten aufbaut, kann diese technische Entwicklung als zusätzliche Absicherung mitdenken.
Quellen:
https://www.anthropic.com/news/claude-text-watermark
https://support.claude.com/en/articles/16266773-how-claude-marks-ai-generated-content
https://www.blogdumoderateur.com/watermark-claude-anthropic-reponses/