
Ein Text sieht aus wie ein ganz gewöhnlicher Text. Keine auffälligen Hinweise auf KI. Keine übermäßige Nutzung von Gedankenstrichen. Keine sprachlichen Auffälligkeiten. Und doch kann künftig eine für Nutzerinnen und Nutzer unsichtbare Signatur in KI-generierten Texten stecken. Das Software-Unternehmen OpenAI führt für Texte, die von ChatGPT stammen, ein neues Wasserzeichen ein.
OpenAI reagiert damit auf die Transparenzvorgaben des europäischen KI-Gesetzes. In den kommenden Wochen soll ein neues Verfahren - „textGrain“ - dafür sorgen, dass von Künstlicher Intelligenz erzeugte Texte technisch leichter erkannt werden können.
Bei „Wasserzeichen“ denken die meisten Menschen vermutlich an eine Art Unterschrift oder an bereits Bekanntes, wie etwa ein Logo über einem Foto. Doch bei KI-Texten soll im fertigen Text davon nichts zu sehen sein.
Wasserzeichen in KI-Texten: So funktioniert „textGrain“ von OpenAI
Das Verfahren „textGrain“, das OpenAI nun einführt, greift bereits bei der Entstehung von Texten in die Auswahl der Wörter ein. Es verändert also nicht nachträglich einzelne Worte oder fügt Sonderzeichen oder unsichtbare Leerzeichen ein.
Dazu muss man wie wissen, wie Sprachmodelle wie ChatGPT bei der Texterstellung vorgehen. Vereinfacht gesagt beruhen sie auf Wahrscheinlichkeiten, das heißt sie berechnen für jedes nächste Wort wie wahrscheinlich es ist, dass es in den Satz passt. textGrain nutzt diese Auswahl und bringt ein statistisches Muster in die so erzeugte Sprache ein. Über längere Textpassagen hinweg können spezielle Detektoren dann überprüfen, ob solche Muster vorhanden sind.
Doch wie zuverlässig lassen sich KI-Texte mit dieser Technik wirklich erkennen? Hier wird es kompliziert. Denn selbst wenn ein solches Wasserzeichen gefunden wird, ist das noch kein eindeutiger Beweis, dass man es tatsächlich mit einem KI-generierten Dokument zu tun hat.
OpenAI selbst verweist auf die Grenzen der Technik. In eigenen Tests habe der Detektor bei einer angestrebten Fehlalarm-Rate von einem Prozent Wasserzeichen in lediglich rund 80 Prozent der untersuchten 200-Token-Texte erkannt. Bei 400 Token stieg die Erkennungsrate auf etwa 95 Prozent. 100 Token entsprechen laut OpenAI in etwa 75 Wörtern.
Kennzeichnungspflicht und interne Regeln: Worauf Schüler, Studierende und Arbeitnehmende achten sollten
Bei Texten mit wenig Varianz bei der Wortwahl, wie zum Beispiel bei mathematischen Aufgaben, sei die Erkennung deutlich schlechter. Nachträgliche Änderungen in Texten können die Wahrscheinlichkeit, dass Wasserzeichen erkannt werden, ebenfalls abschwächen.
In einem weiteren Test mit 400-Token-Texten sei die Erkennungsrate laut OpenAI von 92 auf etwa 66 Prozent gesunken, wenn zehn Prozent der Wörter nachträglich durch Synonyme ersetzt wurden. Werden 25 Prozent der Wörter ausgetauscht, falle die Rate auf 17 Prozent.
Ein Detektor kann demnach nicht zuverlässig feststellen, ob ein Mensch oder eine Maschine einen Text geschrieben hat. Und selbst ein Treffer bedeutet nicht automatisch, dass ein Text vollständig von einer KI erzeugt wurde.
Das erkannte Wasserzeichen könne lediglich darauf hindeuten, dass ein OpenAI-System an der Erstellung oder Bearbeitung eines Textes beteiligt war. Es kann allerdings keine Aussage darüber treffen, wie viel ein Mensch anschließend verändert hat. Auch die umgekehrte Schlussfolgerung trifft nicht automatisch zu: Wird kein Wasserzeichen erkennt, bedeutet das nicht zwangsläufig, dass ein Text ausschließlich von einem Menschen geschrieben wurde.
Ist ein Text besonders kurz, stark bearbeitet, übersetzt worden oder waren andere KI-Systeme abseits von ChatGPT im Einsatz, kann textGrain an seine Grenzen stoßen. Gleiches gilt für Texte aus einer Zeit, in der das Wasserzeichen noch nicht eingesetzt wurde.
Grund für das Einsetzen von textGrain ist der AI Act, also die neuen Regelungen der Europäischen Union. Diese sehen seit August dieses Jahres für bestimmte KI-generierte Inhalte eine maschinenlesbare Kennzeichnung vor.
OpenAI spricht deshalb von „Text Provenance“, also der nachvollziehbaren Herkunft von Inhalten. Das Wasserzeichen soll dabei helfen, den Ursprung eines Textes technisch einzuschätzen. Für Bilder und Audio nutzt OpenAI bereits andere Verfahren zur Herkunftskennzeichnung.
Einen für die Öffentlichkeit zugänglichen Detektor stellt OpenAI vorerst nicht bereit. Das Wasserzeichen soll erstmal nur für ausgewählte Expertenorganisationen zur Verfügung gestellt werden. Grund dafür sind mögliche Fehlalarme.
OpenAI, Google und Anthropic: Hier gibt es künftig Wasserzeichen in KI-Texten
OpenAI ist nicht das erste KI-Unternehmen, das das Wasserzeichen einführt. Mit „SynthID Text“ hat auch Google ein ähnliches Verfahren entwickelt. Auch der Chatbot „Claude“ von Anthropic stattet Texte bereits mit einem Wasserzeichen aus.
Übrigens: Vertrauliche oder persönliche Informationen sollten nicht mit einem Chatbot geteilt werden. Viele Schulen, Unis und Unternehmen haben zudem eigene Regeln im Umgang mit KI, etwa was die Anfertigung von Hausarbeiten betrifft.
Für bestimmte KI-generierte Texte gelten zudem ohnehin Kennzeichnungspflichten, etwa für journalistische Texte. Nutzt man KI privat, um Texte schreiben zu lassen, sie zu ergänzen oder Hilfe bei Formulierungen zu bekommen, sollte man immer selbst noch einmal einen Faktencheck vornehmen. Daten, Zahlen und Fakten sowie deren Quellen sollten überprüft werden. Auch auf mögliche Urheberrechte sollten Nutzerinnen und Nutzer achten.


