KI

ChatGPT bekommt in der EU ein unsichtbares Wasserzeichen, das OpenAI 2024 noch zurückhielt

Adrian Kessler
Fügen Sie uns bei Google hinzu

Lange hat OpenAI öffentlich erklärt, warum ChatGPTs Texte kein Wasserzeichen bekommen sollten. Jetzt führt das Unternehmen es trotzdem ein. Die Technik hat OpenAI nicht umgestimmt. Ausschlaggebend war ein Gesetz mit Frist und Bußgeld.

Texte, die ChatGPT und Codex für Nutzer in der Europäischen Union erstellen, erhalten laut OpenAI eine unsichtbare statistische Signatur. In den kommenden Wochen soll sie schrittweise für alle Tarife eingeführt werden. Anderswo gibt es dieselbe Markierung nur als zuschaltbare Option in der Entwickler-API – standardmäßig ist sie deaktiviert. Die Grenze, die OpenAI gezogen hat, verläuft entlang der Zuständigkeit jener Behörde, die das Unternehmen bestrafen kann.

So funktioniert das ChatGPT-Wasserzeichen

Die Methode namens textGrain hinterlässt keine sichtbaren Spuren im Text. Wenn mehrere mögliche nächste Wörter gleichermaßen gut in einen Satz passen, gibt ein geheimer Schlüssel einem davon den Vorzug. Ein einzelner Impuls bedeutet nichts. Hunderte solcher Impulse ergeben über eine Passage hinweg ein Muster, das sich mit einem Detektor und dem passenden Schlüssel überprüfen lässt. Weil das Signal in den Wörtern selbst steckt, bleibt es auch nach dem Kopieren und Einfügen erhalten. Den technischen Bericht verfasste OpenAI gemeinsam mit Forschern der University of Pennsylvania und der Yale University. Dem Bericht zufolge leidet die Qualität nicht nennenswert: Auf dem Artificial Analysis Intelligence Index erreichten Texte mit Wasserzeichen 49,76 Punkte, Texte ohne Markierung 49,57.

Das Werkzeug, das OpenAI schon hatte

Neu ist das alles innerhalb von OpenAI nicht. Im Sommer 2024 berichtete das Wall Street Journal, das Unternehmen verfüge über ein funktionierendes Text-Wasserzeichen, das internen Dokumenten zufolge zu 99,9 Prozent wirksam sei – und halte es zurück. OpenAI erklärte damals, man gehe „bewusst und umsichtig“ vor. Als Gründe nannte das Unternehmen technische und gesellschaftliche Bedenken: Die Methode sei für böswillige Akteure „leicht zu umgehen“, etwa durch Übersetzung oder Umformulierung mithilfe eines anderen Modells. Zudem könne sie KI als Schreibhilfe für Menschen stigmatisieren, deren Muttersprache nicht Englisch ist. TechCrunch erinnert in seinem Bericht über die Ankündigung dieser Woche an einen dritten damaligen Grund: OpenAI habe befürchtet, Nutzer könnten zu Konkurrenten wechseln, die kein Wasserzeichen einsetzen.

Vor diesem Hintergrund zeigt die neue Einführung, welche dieser Bedenken OpenAI tatsächlich ausgeräumt hat. Das Problem der Umgehung besteht nach den eigenen Zahlen des Unternehmens weiterhin. Das wirtschaftliche Risiko hat OpenAI auf einen einzigen Markt begrenzt.

OpenAIs Zahlen – nicht die der Kritiker

Unter günstigen Bedingungen erkennt der Detektor bei einer Falsch-Positiv-Rate von 1 Prozent rund 80 Prozent der markierten Passagen mit 200 Tokens und etwa 95 Prozent bei 400 Tokens. Ersetzt man 10 Prozent der Wörter durch Synonyme, sinkt die Erkennungsrate von 92 auf 66 Prozent. Bei einem Viertel der Wörter fällt sie auf 17 Prozent. Kurze Antworten, Mathematik und übersetzte Texte sind besonders schwer zu erkennen. OpenAI warnt selbst, dass eine gute Leistung unter idealen Bedingungen „keine zuverlässige Erkennung im Alltag garantiert“ und das Fehlen eines Wasserzeichens nichts darüber aussagt, ob ein Text von einem Menschen stammt. Außerdem identifiziert die Markierung laut OpenAI nicht den Nutzer.

textGrain ist damit ein brauchbares Signal gegen bequemes Kopieren und Einfügen, aber wenig wirksam gegen jeden, der eine Minute in die Bearbeitung investiert. In einem Staatenverbund, in dem in vielen Sprachen gelesen und geschrieben wird, ist die Lücke bei Übersetzungen kein nebensächliches Detail.

Warum die EU – und warum jetzt?

Rechtliche Grundlage ist Artikel 50 des AI Act, dessen Transparenzvorschriften am 2. August in Kraft traten. Anbieter generativer Systeme müssen synthetische Texte, Audios, Bilder und Videos maschinenlesbar kennzeichnen und einen Mechanismus zu ihrer Erkennung bereitstellen. Für Systeme, die bereits vor diesem Datum auf dem Markt waren – darunter ChatGPT –, gilt eine Übergangsfrist bis zum 2. Dezember. Verstöße können nach einer Analyse der Kanzlei Cooley mit bis zu 15 Millionen Euro oder 3 Prozent des weltweiten Jahresumsatzes geahndet werden, je nachdem, welcher Betrag höher ist.

Zwei Details zeigen, wie eng die Einführung an der gesetzlichen Verpflichtung und nicht an einem grundsätzlichen Bekenntnis ausgerichtet ist. Das erste ist der Detektor. Das Gesetz verlangt einen Mechanismus zur Erkennung; OpenAI hat einen entwickelt, stellt ihn aber nur zugelassenen Forschern und Fachorganisationen zur Verfügung, die einen Antrag stellen müssen. Das Unternehmen will den Zugang ausweiten, „wenn wir glauben, dass sich die Ergebnisse verantwortungsvoll interpretieren lassen“, wie The Decoder berichtet, hat dafür aber keinen Zeitplan genannt. Eine Lehrkraft oder ein Redakteur in Lissabon oder Warschau kann einen verdächtigen Text heute nicht überprüfen.

Das zweite Detail ist die geografische Abgrenzung. Anthropic versieht Claude-Texte seit August mit einem Wasserzeichen – weltweit und unabhängig davon, wie Nutzer auf seine Modelle zugreifen. Dafür musste das Unternehmen von einigen Nutzern Kritik einstecken. OpenAI wählte den entgegengesetzten Weg: standardmäßig aktiviert dort, wo eine Aufsichtsbehörde Bußgelder verhängen kann; anderswo eine Option, die Entwickler selbst einschalten müssen; zum Start keine weltweite Voreinstellung. Wäre die alte Sorge, Nutzer könnten zu Konkurrenten ohne Wasserzeichen abwandern, verschwunden, gäbe es wenig Grund für eine solche Grenzziehung.

Wie es weitergeht

OpenAI will textGrain als Open Source veröffentlichen und erklärt, die Methode erreiche mindestens die Leistung anderer Ansätze wie Googles SynthID. Sobald der Code öffentlich ist, lassen sich beide Aussagen überprüfen. Für Brüssel stellt sich eine engere Frage: Erfüllt eine Markierung, die schon bei leichter Bearbeitung verblasst und von einem Detektor ausgelesen wird, den fast niemand nutzen kann, eine Vorschrift, die anderen Systemen ermöglichen soll, KI-Texte zu erkennen?

Nach dem 2. Dezember werden standardmäßig nur noch die ChatGPT-Nutzer Texte mit OpenAIs Signatur erzeugen, deren Aufsichtsbehörde dem Unternehmen die Rechnung schicken kann.

Schlagwörter: , , , ,

Fügen Sie uns bei Google hinzu

Diskussion

Es gibt 0 Kommentare.