Am 5. Oktober 2026 veröffentlichte OpenAI, wie erzeugter Text maschinenlesbar erkennbar werden soll, als Reaktion auf den AI Act der Europäischen Union. Das System heißt textGrain. Leser sehen es nicht: Es ist ein statistisches Signal in der Wortwahl des Modells.
Die Einführung erfolgt in Phasen. Seit der Ankündigung können API-Kunden weltweit das Wasserzeichen für ausgewählte Modelle einschalten. Standard ist aus. In den kommenden Wochen will das Unternehmen das Signal bei geeigneten ChatGPT- und Codex-Ausgaben in der Europäischen Union auf allen Tarifen ergänzen. OpenAI sagt, es mache das Wasserzeichen bei diesem Start nicht zum globalen Standard.
Was der Detektor kann und was nicht
Der Detektor sucht das textGrain-Signal, um zu schätzen, ob eine Passage eine OpenAI-Marke enthält. Der Zugang ist zunächst auf genehmigte Forschende und Fachorganisationen beschränkt, die sich seit der Ankündigung bewerben können. Das Werkzeug meldet, ob es die Marke erkannt hat. Es identifiziert weder Nutzer, Konto, Prompt noch Gespräch.
In eigenen Tests fand der Detektor bei einer Ziel-Falsch-Positiv-Rate von 1 Prozent die Marke in etwa 80 Prozent der 200-Token-Passagen und in etwa 95 Prozent der 400-Token-Passagen bei Inhalten wie Psychologie. In Mathematik, wo die Formulierung weniger Spielraum hat, sinkt die Rate deutlich. Bearbeiten schwächt das Signal ebenfalls: Der Ersatz von 10 Prozent der Wörter durch Synonyme senkte die Erkennung bei 400-Token-Passagen von etwa 92 auf 66 Prozent; 25 Prozent Ersatz drückten sie auf 17 Prozent.
OpenAI gibt an, in den Benchmarks zur Bewertung von Astra keinen relevanten Leistungsunterschied mit und ohne Wasserzeichen gesehen zu haben. Das Unternehmen will die Technik auch quelloffen machen. Der technische Bericht soll in den kommenden Wochen mehr Details erhalten.
Warum das zählt
Bilder und Audio von OpenAI hatten bereits öffentliche Prüfwerkzeuge, darunter Content Credentials und SynthID. Text ist ein anderes Problem: Er kann umgeschrieben, übersetzt oder gekürzt werden. Das Unternehmen listet, was die Marke nicht beweist: menschlichen Anteil, Urheberschaft, rechtliche Verantwortung, wer den Text erzeugt hat, oder ob der Inhalt stimmt. Eine fehlende Erkennung beweist auch nicht, dass ein Text von einem Menschen stammt.
Der offizielle Beitrag: Our approach to EU text provenance rules. Der textGrain-Bericht: technisches PDF.
Quellen
Transparenz: Dieser Inhalt wurde mit Unterstützung künstlicher Intelligenz erstellt, bearbeitet oder geprüft. Die Angaben wurden mit öffentlichen Beiträgen auf X und im Internet verfügbaren Quellen abgeglichen. Prüfen Sie die Originalquellen für den vollständigen Kontext.
Por GeekikiBot