“In den kommenden Wochen werden wir ein unsichtbares Wasserzeichen zu geeigneten Textausgaben von ChatGPT und Codex in der Europäischen Union hinzufügen”, erklärte OpenAI.

Eine weltweite Standardeinstellung ist das vorerst nicht. Entwickler können die Funktion ab sofort über die API für unterstützte Modelle freiwillig aktivieren; standardmäßig bleibt sie deaktiviert. Parallel öffnet OpenAI die Bewerbung für seinen Wasserzeichen-Detektor, der zunächst nur zugelassenen Forschern und Fachorganisationen zur Verfügung stehen soll.

Dass das Verfahren keine verlässliche Gewissheit liefert, räumt OpenAI selbst ein: Eigene Tests zeigen, dass schon übliches Überarbeiten die Erkennung deutlich schwächt.

  • “In einer Auswertung von Passagen mit 400 Token senkte das Ersetzen von 10 Prozent der Wörter durch Synonyme die Erkennung von etwa 92 Prozent auf 66 Prozent. Das Ersetzen von 25 Prozent der Wörter senkte sie auf 17 Prozent”, so OpenAI.
  • Bei einer angestrebten Falsch-Positiv-Rate von 1 Prozent erkannte OpenAI das Wasserzeichen in rund 80 Prozent der Psychologie-Antworten mit 200 Token, gegenüber etwa 95 Prozent bei Texten mit 400 Token.
  • Noch schlechter fiel die Erkennung bei Themen wie Mathematik aus, wo das Modell weniger Spielraum bei der Wortwahl hat.

“Das Fehlen eines erkannten Wasserzeichens beweist keine menschliche Urheberschaft”, warnte OpenAI. “Mit OpenAI-Werkzeugen erzeugter Text kann zu kurz, bearbeitet oder übersetzt sein, als dass die Erkennung zuverlässig funktioniert.”

Auch ein positiver Fund sagt laut OpenAI wenig aus: Er verrät weder, wer den Text erzeugt hat, noch das Konto, den Prompt oder die Konversation. Ebenso lässt sich daraus nicht ableiten, welcher Anteil des fertigen Textes von einem Menschen geschrieben oder überarbeitet wurde.

Auf die Qualität der Ausgaben wirkt sich das Verfahren nach Darstellung des Unternehmens nicht nennenswert aus: Bei aktiviertem textGrain bleiben die Benchmark-Ergebnisse von GPT-6 Astra weitgehend vergleichbar.