OpenAI kündigt Einhaltung des EU-AI-Gesetzes an und führt Text-Wasserzeichen zur Identifizierung von KI-generierten Inhalten ein

·von TechRitual Editorial·Nachrichten
OpenAI kündigt Einhaltung des EU-AI-Gesetzes an und führt Text-Wasserzeichen zur Identifizierung von KI-generierten Inhalten ein
✏️ Redaktionsrecherche| TechRitual World Redaktion

OpenAI hat heute angekündigt, wie es dem EU-Gesetz über künstliche Intelligenz folgen wird, das von Anbietern generativer KI-Systeme verlangt, KI-generierte Texte auf erkennbare Weise zu kennzeichnen. Hier sind die Einzelheiten.

Im Hintergrund hatte Anthropic vor einigen Monaten für Aufsehen gesorgt, als es ankündigte, dass Claude beginnen würde, Texte durch leichte Anpassungen der Wortwahl zu kennzeichnen, um dem EU-Gesetz über künstliche Intelligenz zu entsprechen. Kurz gesagt, Claude wählt manchmal zwischen bedeutungsähnlichen Wörtern basierend auf einem versteckten Muster, wobei Anthropic angibt, dass dies keine wesentlichen Auswirkungen auf die Bedeutung, Qualität oder Lesbarkeit seiner Antworten hat. Anthropic hat auch einen Detektor entwickelt, der nach diesem Muster in Texten sucht und beurteilt, ob der Text möglicherweise von Claude stammt.

Der Detektor kann jedoch nicht verwendet werden, um festzustellen, ob ein Text von OpenAI oder anderen Wettbewerbern stammt, da Claudes Wasserzeichen mit einem exklusiven geheimen Schlüssel des Anthropic-Systems erzeugt wird.

In der Hochphase der Kontroversen betonte Anthropic, dass Claude nicht allein sei, und wies darauf hin, dass auch andere große Anbieter von künstlicher Intelligenz Kennzeichnungssysteme implementieren, um den Anforderungen der EU zu entsprechen. Heute hat OpenAI seine eigene Lösung angekündigt, die zwar eine ähnliche Methode verwendet, aber in ihrem Umfang und ihrer Reichweite relativ begrenzt ist.

OpenAI wird in den kommenden Wochen Wasserzeichen für ChatGPT und Codex hinzufügen

Laut OpenAI „werden API-Kunden weltweit die Möglichkeit haben, für ausgewählte Modelle Textwasserzeichen zu aktivieren“, während das Unternehmen „in den kommenden Wochen unsichtbare Wasserzeichen für die qualifizierten Textausgaben von ChatGPT und Codex hinzufügen wird“. Das bedeutet, dass die Textwasserzeichen in der aktuellen API standardmäßig deaktiviert sind, und dass die Funktion zunächst nur für qualifizierte Nutzer in der EU verfügbar sein wird.

OpenAI hat auch den Zugang zu seinem Textwasserzeichen-Detektor eröffnet, zunächst nur für genehmigte Forscher und Fachinstitutionen, während das Unternehmen die Technologie bewertet und verbessert. Bezüglich der Genauigkeit stellt OpenAI klar, dass die Detektionstechnologie erhebliche Einschränkungen aufweist und sowohl falsch-positive als auch falsch-negative Ergebnisse liefern kann, insbesondere bei kürzeren Texten oder Inhalten aus bestimmten Bereichen, „zum Beispiel Mathematik, da die Wortwahl dort weniger flexibel ist.“

OpenAI erwähnt seine Textwasserzeichen-Technologie textGrain, die ein unsichtbares statistisches Signal zu den Wortwahlen des Modells hinzufügt. Der Detektor sucht nach diesem Signal, um zu bewerten, ob ein Text das Wasserzeichen von OpenAI enthält. Weitere Details zur Funktionsweise von textGrain werden in unserem technischen Bericht zu finden sein, der in den kommenden Wochen aktualisiert wird. Wir planen auch, die Technologie als Open Source zur Verfügung zu stellen, damit andere darauf basierend entwickeln können.

Das Unternehmen weist auch darauf hin, dass die Wasserzeichen nicht nur in kürzeren Absätzen schwerer zu erkennen sind, sondern dass auch Änderungen durch Bearbeitung das Wasserzeichen erheblich schwächen können: Bei der Bewertung von 400 markierten Absätzen sank die Erkennungsrate von etwa 92 % auf 66 %, wenn 10 % der Wörter durch Synonyme ersetzt wurden. Nach dem Ersetzen von 25 % der Wörter fiel die Erkennungsrate auf 17 %. Interessanterweise zeigt der Vergleich zwischen wasserzeichen- und nicht-wasserzeichenbehafteten Texten, dass die wasserzeichenbehafteten Ausgaben in mehreren Benchmarks tatsächlich etwas besser abschnitten, obwohl das Unternehmen angibt, keine signifikanten Unterschiede in der Gesamtleistung festgestellt zu haben.

BenchmarkNicht-wasserzeichenbehafteter Text (Astra, max)Wasserzeichenbehafteter Text (Astra, max)
Künstliche Analyseintelligenz-Index49,57 Punkte49,76 Punkte
Automatisierter Benchmark34,09%34,86%
DeepSWE v1.172,80%71,68%
Terminal Benchmark 4.053,90%56,06%
Terminal Benchmark Wissenschaft 0.156,90%60,00%
BrowseComp87,92%87,35%
HealthBench Professional64,27%64,60%
GPQA Diamond94,44%93,94%

OpenAI betont auch, dass das Wasserzeichen „keine menschlichen Beiträge misst“, „keine Eigentumsrechte oder Verantwortlichkeiten festlegt“, „keine Nutzer identifiziert“ und „keine Genauigkeit verifiziert“. OpenAI fügt hinzu, dass „das Fehlen eines erkannten Wasserzeichens nicht beweist, dass es sich um menschliche Kreation handelt.“ Schließlich erklärt das Unternehmen, dass es seine Methoden im Laufe der Zeit neu bewerten wird, während sich die Technologie, Standards und Beweise weiterentwickeln, und dass es weiterhin erforschen wird, ob Wasserzeichen in Bearbeitung und Übersetzung besser überleben können und ob sie sinnvoller zwischen KI-unterstützter und KI-generierter Kreation unterscheiden können.

Originalartikel auf techritual.com lesen (traditionelles Chinesisch) →

T
Über den Autor
TechRitual Editorial

The TechRitual editorial desk in Hong Kong. Articles on TechRitual World are translated from the Traditional Chinese originals on techritual.com.