Texte aus ChatGPT und Codex bekommen in der EU bald eine Markierung, die niemand sieht, die sich aber technisch nachweisen lässt. OpenAI reagiert damit auf die Kennzeichnungspflicht aus dem AI Act – und räumt zugleich ein, wie leicht sich das Signal abschwächen lässt.
OpenAI, das Unternehmen für KI-Forschung und deren praktische Anwendung, hat in einer Mitteilung zu den EU-Regeln für die Herkunft von Texten beschrieben, wie es KI-generierte Texte künftig kennzeichnet. Hintergrund ist Artikel 50 des AI Act, dessen Transparenzpflichten seit dem 2. August 2026 gelten.
Danach müssen Anbieter generativer KI ihre Ausgaben maschinenlesbar so markieren, dass sie als künstlich erzeugt erkennbar sind. Für Texte setzt OpenAI dafür auf ein Wasserzeichen in der Wortwahl selbst. Gelten soll es in allen Tarifen von ChatGPT, auch im Gratis-Tarif.
Das Wichtigste in Kürze
- In den kommenden Wochen erhalten Texte aus ChatGPT und Codex in der EU ein unsichtbares Wasserzeichen, über alle Tarife hinweg.
- Außerhalb der EU bleibt ChatGPT ohne Wasserzeichen, das gilt auch für die Schweiz.
- In der API können Kunden weltweit ab sofort freiwillig ein Wasserzeichen aktivieren, standardmäßig bleibt es aus.
- Den Detektor, der das Wasserzeichen erkennt, bekommen zunächst nur ausgewählte Forscher und Fachorganisationen.
So funktioniert textGrain
Das Verfahren heißt textGrain. Es legt ein unsichtbares statistisches Signal in die Wortwahl des Modells: Wo mehrere Formulierungen gleich gut passen, folgt die Auswahl einem verborgenen Muster. Ein Detektor sucht in einem Text nach genau diesem Muster.
Auf die Qualität der Antworten hat das laut OpenAI keinen nennenswerten Einfluss. In acht Benchmarks des aktuellen Modells Astra liegen die Werte mit und ohne Wasserzeichen dicht beieinander, teils knapp darüber, teils knapp darunter. Die Technik will OpenAI zudem als Open Source veröffentlichen, ein technischer Bericht beschreibt sie bereits.
Wie zuverlässig die Erkennung ist
OpenAI nennt die Grenzen des Verfahrens selbst und mit Zahlen. Bei einer Fehlalarmrate von einem Prozent erkannte der Detektor das Wasserzeichen in rund 80 Prozent der Passagen mit 200 Token und in rund 95 Prozent der Passagen mit 400 Token, gemessen an Texten zur Psychologie. Bei Mathematik, wo die Wortwahl weniger Spielraum lässt, lagen die Werte deutlich niedriger.
Noch stärker wirkt Nachbearbeitung:
| Ersetzte Wörter (400 Token) | Erkennungsrate |
|---|---|
| keine | rund 92 % |
| 10 % durch Synonyme | rund 66 % |
| 25 % durch Synonyme | rund 17 % |
Ein Wasserzeichen sagt zudem nichts darüber, wie viel ein Mensch am Text beigetragen hat, wem er gehört, wer ihn erstellt hat oder ob er stimmt. Fehlt es, beweist das umgekehrt nicht, dass ein Mensch den Text geschrieben hat.
Nicht der erste Anbieter
Mit dem Schritt folgt OpenAI einem ähnlichen Ansatz wie Anthropic. Der Anbieter von Claude hatte im Sommer angekündigt, Texte über eine leicht veränderte Wortwahl zu markieren.
Ein gemeinsamer Detektor entsteht dadurch nicht. Das Werkzeug von OpenAI prüft nur, ob ein Text ein Wasserzeichen von OpenAI enthält – Texte aus anderen Modellen erkennt es nicht als KI-generiert.
Ein Signal mit kurzer Reichweite
Ich halte das Wasserzeichen in seiner jetzigen Form vor allem für eine Erfüllung der Pflicht, nicht für ein Werkzeug, mit dem sich KI-Texte im Alltag zuverlässig entlarven lassen. Ein Viertel der Wörter auszutauschen genügt, um die Erkennung auf unter ein Fünftel zu drücken, und der Detektor ist ohnehin nicht öffentlich.
Für Nutzer in Deutschland und Österreich ändert sich in ChatGPT sichtbar nichts, die Markierung steckt allein in der Wortwahl. In der Schweiz, die nicht zur EU gehört, bleiben die Texte ohne Wasserzeichen.
Hältst du ein Wasserzeichen in KI-Texten für sinnvoll, wenn es sich schon durch das Austauschen einiger Wörter aushebeln lässt? Schreib uns in die Kommentare, wo du die Grenze ziehen würdest.





