Unsichtbares Wasserzeichen: Anthropic markiert künftig alle Claude-Texte

Was geschah

Anthropic weitet sein unsichtbares Text-Wasserzeichen auf die gesamte Claude-Modellpalette aus. Wie heise online unter Berufung auf The Decoder berichtet, sollen ab dem 30. September 2026 auch Claude Fable 5, Claude Sonnet 5 und Claude Opus 4.8 entsprechend markierte Ausgaben erzeugen. Bis zum 2. Dezember werden laut einer Kunden-E-Mail auch die älteren Modelle nachgerüstet. Bereits markiert sind Claude Fable 5.1, Claude Mythos 5.1, Claude Opus 5.5 und Claude Opus 5.

Das Wasserzeichen wird auf Modellebene angewendet — Nutzer können es nicht deaktivieren. Und obwohl die EU der Auslöser ist, gilt die Markierung weltweit auf allen Claude-Plattformen.


Die Technik: Statistik statt Metadaten

Anthropic setzt auf eine eigene Variante von Google DeepMinds SynthID-Text. Statt unsichtbarer Zeichen oder Metadaten, die sich einfach entfernen ließen, beeinflusst das Verfahren die Token-Auswahl des Modells selbst: Unter mehreren plausiblen nächsten Wörtern entscheidet sich das Modell leicht bevorzugt für bestimmte Varianten. Über längere Passagen entsteht so ein statistisches Muster, das sich mit dem passenden Schlüssel erkennen lässt — ohne dass der Text sich für den Leser verändert. Anthropic zufolge beeinträchtigt das die Textqualität praktisch nicht.

Das ist der entscheidende Unterschied zu Kennzeichnungen in Metadaten: Das Wasserzeichen ist Teil des Textes selbst. Kopieren, Formatieren, Weitergeben — das Muster bleibt.


Der Auslöser: EU AI Act

Hintergrund sind die Transparenzpflichten des EU AI Act: Seit dem 2. August 2026 müssen Entwickler generativer KI-Systeme dafür sorgen, dass KI-generierte Inhalte maschinenlesbar gekennzeichnet sind. Anthropic hatte das Wasserzeichen Mitte August angekündigt; alle seit Anfang September veröffentlichten Modelle tragen es ab Start.

Die EU schreibt die Kennzeichnung nur für ihren Hoheitsbereich vor — Anthropic geht darüber hinaus und markiert weltweit. Für Kunden außerhalb der EU mag das freiwillig wirken, aber es ist auch eine Absicherung: Ein Modell, das nur in EU-Instanzen markiert, wäre trivial unterscheidbar. Ein einheitliches Verhalten ist einfacher — und es signalisiert Regulierern weltweit, dass man bei Transparenz mitzieht.


Die Grenzen: Wahrscheinlichkeit statt Beweis

Als Herkunftsnachweis hat das Verfahren klare Grenzen — die Anthropic selbst einräumt:

  • Ein Treffer zeigt nur, dass Claude wahrscheinlich beteiligt war — etwa beim Übersetzen, Zusammenfassen oder Bearbeiten eines fremden Textes.
  • Starkes Umschreiben, Paraphrasieren, nachträgliches Übersetzen oder das Vermischen mit anderem Text kann das Signal abschwächen oder entfernen.
  • Bei sehr kurzen Passagen fehlt das statistische Material.
  • Umgekehrt beweist ein fehlendes Wasserzeichen nicht, dass ein Text von einem Menschen stammt.

Das Wasserzeichen ist also kein Lügendetektor. Es ist ein Indiz — stärker als nichts, schwächer als ein Beweis.


Das offene Problem: Der Detektor

Der im August angekündigte Detektor existiert inzwischen — aber die zugehörige API befindet sich noch in privater Vorschau und ist nur für bestimmte Organisationen und Personen verfügbar. Einen frei zugänglichen Detektor für Claudes Text-Wasserzeichen gibt es nicht.

Damit entsteht eine bemerkenswerte Asymmetrie: Jeder Claude-Text trägt ab sofort ein Wasserzeichen, aber nur wenige dürfen prüfen. Für den EU-Kennzeichnungszweck reicht das — dort geht es um Anbieterpflichten, nicht um Bürger-Audits. Aber für alle, die tatsächlich herausfinden wollen, ob ein Text von einer KI stammt, ändert sich praktisch nichts: Ohne Zugang zum Detektor ist das unsichtbare Muster unsichtbar geblieben.


Die eigentliche Lektion

Anthropic macht hier zwei Dinge gleichzeitig: Es erfüllt eine regulatorische Pflicht — und es baut ein Kontrollinstrument auf, dessen Schlüssel in der eigenen Hand bleiben. Das ist kein Widerspruch, aber es ist die Struktur, die man kennen sollte: Die Markierung ist verpflichtend, die Überprüfung privilegiert. Solange der Detektor nicht öffentlich ist, ist das „Wasserzeichen für alle" faktisch ein „Wasserzeichen für Anthropic und die von Anthropic Ausgewählten".

Für die Debatte um KI-Detektion ist das die nächste Runde eines bekannten Spiels: Detektoren versprechen Herkunftsnachweis, die Praxis liefert Wahrscheinlichkeiten mit Lücken — und wer den Inhalt manipulativ umschreiben lässt, kann das Signal tilgen, während der ehrliche Nutzer es trägt. Ein fehlendes Wasserzeichen wird trotzdem schon jetzt als Argument zitiert werden („siehst du, vom Menschen!"). Es ist keins. Die einzige verlässliche Aussage dieses Verfahrens lautet: Wo ein Treffer ist, war Claude sehr wahrscheinlich beteiligt. Alles andere bleibt Interpretation.


Quellen