Unsichtbare Wasserzeichen in KI-Texte

Klingt fast wie Zauberei: Du kopierst einen Text aus Claude, fügst ihn in Word ein und entfernst die Formatierung. Sind damit alle Spuren verschwunden? Nein, denn Anthropic versieht Texte seiner KI künftig mit einem unsichtbaren Wasserzeichen. Dieses steckt nicht in geheimen Zeichen, sondern in der Auswahl der Wörter.
Ein Muster in der Wortwahl...
Eine KI entscheidet Wort für Wort, wie ein Satz weitergeht. Oft stehen mehrere gleich passende Begriffe zur Auswahl. Claude nutzt solche Entscheidungen, um mithilfe eines geheimen Schlüssels ein statistisches Muster zu erzeugen. Beim Lesen bemerkst du davon nichts. Es gibt keine versteckten Zeichen, zusätzlichen Leerzeichen oder sichtbaren Markierungen. Neue Claude-Modelle sollen das Verfahren von Beginn an verwenden. Bei älteren Modellen wird es schrittweise ergänzt. Anthropic reagiert damit auf die Transparenzvorgaben des europäischen AI Acts.
Können Lehrer das erkennen...
Derzeit können Lehrer das Wasserzeichen nicht selbst erkennen. Es wird weder in Word noch beim Anzeigen von Sonderzeichen sichtbar. Auch gewöhnliche KI-Detektoren können das geheime Claude-Muster nicht gezielt auslesen. Anthropic arbeitet jedoch an einem offiziellen Prüfwerkzeug. Sobald dieses verfügbar ist, könnten auch Schulen längere Texte überprüfen. Je länger der Text ist, desto zuverlässiger soll die Erkennung funktionieren. Bei kurzen Antworten, Faktenlisten, Code oder kleinen Rechtschreibkorrekturen ist das Signal deutlich schwächer. Lehrer können KI-Texte momentan also höchstens vermuten. Hinweise können ein plötzlich veränderter Schreibstil, ungewöhnliche Formulierungen oder Antworten sein, die ein Schüler nicht erklären kann. Sicher beweisen lässt sich die Verwendung damit nicht.
Was beweist ein Treffer...
Ein erkanntes Wasserzeichen zeigt nur, dass Claude wahrscheinlich an einem Text beteiligt war. Es verrät weder den Namen noch das Benutzerkonto oder den ursprünglichen Chat. Die Prüfung kann außerdem nicht unterscheiden, ob Claude den gesamten Text geschrieben oder einen menschlichen Text stark überarbeitet hat. Ein Treffer allein darf daher kein Beweis für einen Täuschungsversuch sein. Aufgabenstellung, Arbeitsprozess, frühere Texte und ein persönliches Gespräch bleiben für Lehrer wesentlich wichtiger.
Kann man das Wasserzeichen entfernen...
Kopieren, Einfügen oder das Löschen der Formatierung bringt nichts, denn das Muster steckt in den verwendeten Wörtern. Auch kleine Änderungen reichen vermutlich nicht aus. Erst eine vollständige Neufassung zerstört das Muster zuverlässig – dann ist es allerdings tatsächlich ein neuer Text. Sinnvoller ist es, KI für Ideen, Erklärungen, Recherche oder eine Gliederung zu verwenden und den endgültigen Text selbst zu schreiben. So entsteht ein persönlicher Stil, und du kannst deine Aussagen auch erklären.
Der EU AI Act als Auslöser
Claude führt das Wasserzeichen nicht freiwillig aus Misstrauen gegenüber seinen Nutzern ein. Hintergrund ist der EU AI Act: Anbieter generativer KI müssen ihre Inhalte maschinenlesbar kennzeichnen. Anthropic hat sich dafür entschieden, ein statistisches Muster in die Wortwahl einzubauen und dieses Verfahren weltweit einzusetzen.
Macht ChatGPT das ebenfalls...
Nach dem derzeit veröffentlichten Stand enthalten Textantworten von ChatGPT noch kein vergleichbares OpenAI-Wasserzeichen. Auch ChatGPT dürfte künftig ein Wasserzeichen für Texte erhalten. OpenAI hat angekündigt, seine bereits bei Bildern und Audiodateien verwendeten Herkunftssignale auf weitere Inhalte auszuweiten. Wann dies geschieht und welche Technik dabei eingesetzt wird, ist derzeit noch offen.
Fazit
Das Claude-Wasserzeichen ist ein unsichtbares Muster in der Wortwahl. Lehrer können es derzeit noch nicht überprüfen, künftig könnte dafür aber ein offizielles Werkzeug verfügbar sein. Selbst dann beweist ein Treffer nur die Beteiligung von Claude – nicht automatisch einen Schummelversuch. Der eigene Schreibstil, der nachvollziehbare Arbeitsprozess und das Verständnis des Inhalts bleiben entscheidend.