Kennzeichnung · Anthropic
Claude schreibt ab sofort ein unsichtbares Zeichen in jeden Text — und beweist damit weniger, als alle hoffen
Anthropic hat am 11. August angekündigt, Ausgaben seiner Modelle künftig maschinenlesbar zu markieren. Bei Text geschieht das über ein Wasserzeichen, das direkt beim Erzeugen in die Wortwahl eingebettet wird; bei Dateien über C2PA, einen offenen Standard für digital signierte Herkunftsangaben. Betroffen sind die Claude-Plattform (API), Claude selbst, Claude Code sowie die Produkte Claude Cowork und Claude Tag.
Die Stichtagsregel ist präzise: Modelle, die am oder nach dem 2. August 2026 erscheinen, unterstützen die Markierung ab Verkaufsstart. Für ältere Modelle will Anthropic sie nachrüsten. Dieses Datum ist kein Zufall — am 2. August trat der Transparenzteil des EU-Regelwerks in Kraft, zu dem sich Anthropic über den Code of Practice on Transparency of AI-Generated Content freiwillig verpflichtet hat. Ausgelöst hat das Ganze also europäisches Recht. Ausgerollt wird es überall, wo Claude angeboten wird, unabhängig vom Wohnort des Nutzers.
Technisch ist der Textteil der interessantere. Ein Text-Wasserzeichen funktioniert, grob gesagt, über eine gesteuerte Verzerrung der Wortwahl: Das Modell bevorzugt beim Erzeugen systematisch bestimmte aus mehreren gleichwertigen Formulierungen, nach einem Muster, das nur mit dem passenden Schlüssel als Signal erkennbar ist. Der Vorteil gegenüber Metadaten liegt auf der Hand, und Anthropic beschreibt ihn selbst so: Weil das Zeichen Teil des Textes sei, wandere es beim Kopieren und Einfügen mit und überstehe auch manche Bearbeitung.
Genau hier beginnen allerdings die Einschränkungen, und Anthropic benennt sie bemerkenswert offen. Bei stärkerer Überarbeitung verschwindet das Zeichen. Die Metadaten der Dateivariante gehen bei Formatwechsel, Screenshot oder Konvertierung verloren — was in der Praxis heißt: Ein Screenshot entfernt den C2PA-Nachweis vollständig. Wie viel Bearbeitung nötig ist, um das Text-Wasserzeichen zu zerstören, sagt das Unternehmen nicht. Diese Zahl wäre die eigentlich entscheidende, und sie fehlt.
Der schwerwiegendste Einwand ist aber kein technischer, sondern ein logischer. Die Markierung weist nach, dass ein Text durch Claude gelaufen ist — nicht, dass Claude ihn geschrieben hat. Wer einen selbst verfassten Text von Claude Korrektur lesen lässt, bekommt ihn markiert zurück. Der US-Radiomoderator Erick Erickson hat genau das öffentlich kritisiert: Seine eigenen, lediglich redigierten Texte trügen nun ein Zeichen, das sie als KI-berührt ausweise. Das ist keine Randnotiz, sondern beschreibt den Normalfall professioneller Textarbeit.
Umgekehrt gilt der Schluss erst recht nicht. Ein Text ohne Wasserzeichen ist kein menschlicher Text — er stammt möglicherweise nur von einem anderen Anbieter, von einem älteren Modell, aus einem offenen Gewichtssatz auf eigener Hardware oder aus einer Umformulierungsschleife. Der Kommentar bei heise online bringt diese Gefahr auf den Punkt: Das größte Risiko sei, dass das technische Signal überbewertet werde und die Abwesenheit eines Wasserzeichens als Echtheitssiegel missverstanden wird. Genau das kann die Markierung nicht leisten.
Für Unternehmen ergeben sich daraus drei sehr konkrete Konsequenzen. Erstens: Die Markierung ist nicht abschaltbar, auch nicht über die API. Wer Claude in ein Produkt eingebaut hat, dessen Ausgaben tragen das Zeichen — das gehört in die Bewertung, wenn Kunden vertraglich ungekennzeichnete Inhalte erwarten. Zweitens: Entwickler äußern die Sorge, dass Signaturen in generiertem Quellcode die Ausgabequalität beeinflussen könnten; belastbare Messungen dazu liegen bislang nicht vor, und wir kennzeichnen das ausdrücklich als offene Frage. Drittens: Anthropic hat zugesagt, Dritten Werkzeuge zum Erkennen der Marken bereitzustellen, wie der Kodex es verlangt — die genaue Dokumentation steht noch aus. Bis dahin lässt sich das Zeichen zwar setzen, aber von außen kaum prüfen.
Wir haben gestern an dieser Stelle ausführlich beschrieben, dass die Kennzeichnungspflicht seit gut einer Woche gilt, während die Nachweistechnik dahinter unzuverlässig bleibt. Anthropics Schritt ist die bislang konsequenteste Umsetzung dieser Pflicht durch ein großes Labor — und zugleich die beste Illustration des Problems. Das Zeichen ist echt. Was es beweist, ist schmaler, als der Begriff „Wasserzeichen“ suggeriert.
- Claude Help Center — How Claude marks AI-generated content
- TechCrunch — Anthropic says it will watermark text generated by its AI models
- heise online — Keine Chance für Schummler: Claude bekommt jetzt ein unsichtbares Wasserzeichen
- heise online (Kommentar) — KI-Wasserzeichen: Ein Stempel, der falsche Sicherheit schafft
- Forbes — Claude Will Put Invisible Watermarks On AI Text And Images
- the decoder — Anthropic versieht Claude mit unsichtbarem Wasserzeichen