KI-Ausbildung

Was ist KI-Wasserzeichen?

Das KI-Wasserzeichen ist eine Strategie zur KI-Erkennung, bei der die Schreibweise von großen Sprachmodellen (LLMs) manipuliert wird. Erfahren Sie, wie es funktioniert, wer es einsetzt, warum es versagt und in welchem Zusammenhang es mit Pangram steht.

14. September 2026

Das Wasserzeichenverfahren ist eine Methode zur Erkennung von KI-generierten Inhalten, die darauf basiert, die Häufigkeit zu manipulieren, mit der ein LLM bestimmte Wörter verwendet. Auf diese Weise lassen sich diese Veränderungen in der Worthäufigkeit erkennen und feststellen, ob ein Text von einem bestimmten KI-Modell verfasst wurde.

Wie funktioniert das Einfügen von Wasserzeichen?

LLMs funktionieren so, dass eine Reihe von Wörtern eingegeben wird und das Modell daraufhin eine Reihe möglicher Wörter ausgibt, die im Satz auf diese Wörter folgen könnten. So schreiben KIs: Sie lesen einen Satz und erstellen eine Liste von Wörtern, die als Nächstes im Satz kommen könnten. Jedem dieser Wörter wird eine Wahrscheinlichkeit zugewiesen, wie sehr das LLM es als Nächstes einfügen möchte. Anschließend wählt das LLM aus dieser Liste ein Wort aus, das tatsächlich als Nächstes folgen soll – jedoch nicht unbedingt (oder gar meistens) das absolut wahrscheinlichste nächste Wort. Würde das LLM bei jedem Satz, der beispielsweise mit „Ich gehe mit meinem …“ beginnt, immer das wahrscheinlichste nächste Wort „Hund“ wählen, würden LLMs jedes Mal, wenn ihnen dieselbe Frage gestellt wird, dasselbe antworten.

Sie haben also einen unvollständigen Satz und eine Liste möglicher nächster Wörter, aus denen Sie wählen können. Bei dem Vorgang, bei dem das LLM das nächste Wort auswählt, kommt das Wasserzeichen ins Spiel: Es beeinflusst die Wahrscheinlichkeiten dieser möglichen nächsten Wörter.

Man kann dies auch wie folgt ausdrücken: Betrachten wir die Menge aller möglichen Wörter, die ein LLM verwenden könnte – also jedes mögliche Wort, das ein KI-Modell jemals sagen könnte. Wir bezeichnen dies als das Vokabular des LLM. Beim Watermarking wird pseudozufällig eine Teilmenge des Vokabulars ausgewählt und ein winziger Modifikator auf deren Wert angewendet, der die Wahrscheinlichkeit erhöht, dass bestimmte Wörter ausgewählt werden.

Eine pseudozufällig ausgewählte Teilmenge des Wortschatzes des LLM wird mit einem Wasserzeichen versehen.Eine pseudozufällig ausgewählte Teilmenge des Wortschatzes des LLM wird mit einem Wasserzeichen versehen.

Wenn das LLM also eine Rangliste potenzieller Wörter erstellt, sorgt der Modifikator dafür, dass diese Wörter in der Liste etwas weiter oben stehen, als es sonst der Fall wäre, und somit mit größerer Wahrscheinlichkeit ausgewählt werden.

Wörter mit Wasserzeichen rücken in der Rangliste der nächsten Wörter des LLM etwas nach obenWörter mit Wasserzeichen rücken in der Rangliste der nächsten Wörter des LLM etwas nach oben

Das Wasserzeichen wird erkannt, indem der Ausgabetext analysiert und ermittelt wird, wie häufig die mit dem Wasserzeichen versehenen Wörter vorkommen. Wenn sie im Text häufiger vorkommen als im Standard-Englisch, gilt dies als positives Ergebnis, und der Wasserzeichen-Detektor gibt zurück, dass der Text von einer KI generiert wurde.

Wie sieht ein KI-Wasserzeichen aus?

KI-Wasserzeichen sind unsichtbar, und Studien deuten darauf hin, dass KI-Wasserzeichen die Qualität der Ergebnisse nicht beeinträchtigen. Das mag auf den ersten Blick widersprüchlich erscheinen: Wenn Wasserzeichen die Wahrscheinlichkeit verändern, mit der bestimmte Wörter in einer LLM-Ausgabe vorkommen, müsste das dann nicht für einen Menschen erkennbar sein – genauso wie wir es bemerken, wenn LLMs Wörter wie „delve“ verwenden?

Das liegt daran, dass die Liste der mit einem Wasserzeichen versehenen Wörter bei jedem Token neu generiert wird. Das heißt, die Teilmenge der Vokabeln, die für ein Wasserzeichen ausgewählt werden, ändert sich mit jedem neuen Wort im Satz. Das bedeutet, dass die Vokabeln eine viel größere Varianz aufweisen, als man erwarten würde, wenn es sich bei der mit einem Wasserzeichen versehenen Menge um eine feste, vorab festgelegte Wortgruppe handeln würde.

Was sind die Vorteile von KI-Wasserzeichen?

Wasserzeichen sind aus mehreren Gründen für die KI-Erkennung von Vorteil. Zunächst einmal lässt sich mit Wasserzeichen bereits bei relativ wenigen Wörtern ein hohes Maß an Sicherheit erzielen, auch wenn die Sicherheit – wie beim Pangram – mit zunehmender Kürze der Segmente abnimmt. Wasserzeichen sind zudem modellspezifisch – während Pangram lediglich angibt, ob ein Text von einer KI generiert wurde, kann ein Wasserzeichen genau erkennen, welches KI-Modell den Text erzeugt hat. Ein positives Ergebnis bei einem Wasserzeichen ist jedoch ebenfalls modellspezifisch: Wenn Sie einen ChatGPT-Text in einen Claude-Wasserzeichen-Detektor eingeben, wird ein negatives Ergebnis zurückgegeben, da das Wasserzeichen nur in von Claude verfassten Texten vorkommt.

Auch für KI-Unternehmen ist die Implementierung von Wasserzeichen einfach: Wasserzeichen lassen sich relativ kostengünstig einrichten, und es ist kein erneutes Training des Modells erforderlich, um sie zu nutzen.

Lässt sich das KI-Wasserzeichen umgehen?

Wasserzeichen sind anfällig und lassen sich leicht durch algorithmische Strategien umgehen, gegen die Pangram robust ist, wie beispielsweise „Humanizer“. Es ist einfach, einen KI-Wasserzeichen-Detektor zu überlisten, indem man Wörter durch Synonyme ersetzt, da das Wasserzeichen in der Wortwahl eingebettet ist. Wasserzeichen sind zudem binär: Der Detektor von Pangram kann zwischen KI-gestützten und gemischten (menschlich und KI-erstellten) Inhalten unterscheiden, während ein Wasserzeichen lediglich angibt, ob ein Text als letzter Schritt durch ein LLM gelaufen ist, bevor er zu Ihnen gelangte.

Zwar lässt sich anhand von Wasserzeichen feststellen, ob ein Modell einen Text verfasst hat, doch ein negatives Ergebnis eines Wasserzeichen-Detektors bedeutet nicht, dass der Text nicht von einer KI generiert wurde oder gar nicht von dem betreffenden Modell stammt: Es besagt lediglich, dass das Wasserzeichen für dieses Modell nicht vorhanden ist. Der Text könnte durchaus von einem anderen Modell verfasst worden sein oder durch einen „Humanizer“ oder ein ähnliches Programm geleitet worden sein, das Wörter im Text durch Synonyme ersetzt hat.

Verwendet Claude KI-basierte Wasserzeichen?

Ja, derzeit verwenden Claude-Modelle KI-Wasserzeichen, um den EU-Vorschriften zu entsprechen: Anthropic hat, wie im eigenen Blog angekündigt, am 2. August 2026 damit begonnen, die Ergebnisse von Claude mit Wasserzeichen zu versehen.

AnbieterText-WasserzeichenUnterzeichneter EU-VerhaltenskodexWer kann das überprüfen?
Gemini (Google)Ja, SynthID-Text ist seit 2024 in Gemini verfügbarJaGoogles SynthID-Detektor (eingeschränkter Zugriff)
Claude (Anthropic)Ja, seit dem 2. August 2026JaAPI zur Erkennung anthropogener Objekte (private Vorschau)
ChatGPT (OpenAI)NeinJaKeine Textprüfung
Meta AI (Meta)NeinJaKeine Textprüfung
Copilot (Microsoft)NeinJaKeine Textprüfung
MistralNeinJa—
Grok (xAI)NeinNein—
Open-Source-Modelle (Llama, DeepSeek usw.)Nein——

Derzeit verfügt ChatGPT nicht über eine KI-Wasserzeichen-Funktion, und es gibt keinen zuverlässigen Detektor oder Prüfer für KI-Wasserzeichen in von ChatGPT generierten Texten.

Hat das Einfügen von Wasserzeichen Auswirkungen auf Pangram?

KI-Wasserzeichen haben kaum Auswirkungen auf die KI-Erkennung durch Pangram. Da Wasserzeichen die Wahrscheinlichkeitswerte der von LLMs verwendeten Wörter lediglich subtil beeinflussen, bleiben mit Wasserzeichen versehene LLM-Ausgaben für Pangram weiterhin erkennbar.

Letztendlich kennzeichnet das Wasserzeichen nur die offensichtlichsten und unveränderten KI-Ergebnisse, bei denen kein Versuch unternommen wurde, den Einsatz der KI zu verschleiern. Wir wollen deutlich differenzierter vorgehen und zwischen KI-Unterstützung, gemischten KI-/menschlichen Texten und vollständig KI-generierten Texten unterscheiden. Im Gegensatz zu Wasserzeichen-Detektoren sind wir zudem unabhängig vom jeweils verwendeten Modell zur Textgenerierung.

Wir betrachten KI-Wasserzeichen als Ergänzung zu Pangram. Außerdem sind wir der Meinung, dass mehr Transparenz hinsichtlich der Urheberschaft durch KI generell gut für die Welt ist.

Häufig gestellte Fragen

Hat ChatGPT ein Wasserzeichen?

Nein, ChatGPT versieht seine Texte nicht mit einem Wasserzeichen. OpenAI hat im Jahr 2024 ein System zur Wasserzeichen-Einfügung entwickelt, dieses jedoch nie veröffentlicht.

Was ist SynthID?

SynthID ist das Wasserzeichen von Google, das seit 2024 in Gemini-Modellen verwendet wird.

Wie kann ich überprüfen, ob ein Text ein KI-Wasserzeichen enthält?

KI-Wasserzeichen-Detektoren werden von dem Unternehmen veröffentlicht, das das Modell entwickelt hat. Um Text auf ein Wasserzeichen zu überprüfen, muss das Unternehmen daher Zugriff auf den privaten Schlüssel gewähren, mit dem das Wasserzeichen generiert wurde. Stand 14. September 2026 hat noch kein KI-Unternehmen einen KI-Wasserzeichen-Detektor für Text öffentlich veröffentlicht, obwohl Gemini über einen öffentlichen Bilddetektor verfügt.

Erkennt Pangram KI-Wasserzeichen?

Pangram unterstützt derzeit keine Erkennung von KI-Wasserzeichen.


Annamieka Aerts

Annamieka ist technische Redakteurin bei Pangram.

Mehr von Annamieka Aerts

Weiterführende Literatur

Die Herausforderung der Leistungsbewertung
KI-Ausbildung

Die Herausforderung der Leistungsbewertung

2. Dezember 2025
KI-Aufsatzprüfer: Was funktioniert tatsächlich bei der Überprüfung von Schüler- und Studententexten?
KI-Ausbildung

KI-Aufsatzprüfer: Was funktioniert tatsächlich bei der Überprüfung von Schüler- und Studententexten?

28. Juli 2026
Mythen und Irrtümer über die Erkennung künstlicher Intelligenz
KI-Ausbildung

Mythen und Irrtümer über die Erkennung künstlicher Intelligenz

25. Februar 2025
Was ist Patchwork-Plagiat?
KI-Ausbildung

Was ist Patchwork-Plagiat?

26. März 2026
Wie funktioniert die KI-Erkennung?
KI-Ausbildung

Wie funktioniert die KI-Erkennung?

9. Oktober 2025
Umfassender Leitfaden zum Erkennen von Schreibmustern künstlicher Intelligenz
KI-Ausbildung

Umfassender Leitfaden zum Erkennen von Schreibmustern künstlicher Intelligenz

2. April 2025