Anthropic erläutert Plan für Text-Wasserzeichen bei Claude
Künftige Claude-Modelle sollen Texte weltweit kennzeichnen, um Transparenzvorgaben des EU AI Act zu erfüllen.
Warum es wichtig ist
Der Schritt zeigt, dass große KI-Anbieter sich von allgemeinen KI-Detektoren hin zu anbieter kontrollierten, schlüsselbasierten Herkunftsprüfungen bewegen. Zugleich macht er die Grenzen des Feldes deutlich: Wasserzeichen liefern Wahrscheinlichkeitsaussagen, sind bei kurzen oder stark eingeschränkten Texten schwächer und können durch umfangreiche Überarbeitung abgeschwächt werden.
Die Kernpunkte
- 1.Künftige Claude-Modelle werden weltweit Text-Wasserzeichen enthalten.
- 2.Anthropic zufolge fügt die Kennzeichnung keine versteckten Zeichen oder zusätzlichen Tokens hinzu.
- 3.Die Erkennung ist probabilistisch und funktioniert bei längeren Passagen besser.
Anthropic teilte mit, dass künftige Claude-Modelle Texte mit einem statistischen Wasserzeichen erzeugen werden, das anzeigen soll, wie wahrscheinlich Claude an der Erstellung einer Passage beteiligt war. Das Unternehmen erklärte, die Methode basiere auf dem SynthID-Text-Ansatz von Google DeepMind, füge keine versteckten Zeichen oder zusätzlichen Tokens hinzu und sei nicht darauf ausgelegt, einzelne Nutzer, Organisationen oder Chats zu identifizieren. Anthropic will die Änderung zum Start weltweit einführen, um Anforderungen des EU AI Act zu erfüllen, und plant eine API zur Erkennung von Wasserzeichen.
⚡ Heute ausprobieren
Überprüfen Sie jetzt Veröffentlichungs- und Compliance-Abläufe für mit Claude erzeugte Inhalte und planen Sie Anthropics kommende Erkennungs-API dort ein, wo Herkunftsprüfungen wichtig sind.
Quellen & Originalberichte
Dieser Brief fasst die Berichterstattung der folgenden Medien zusammen und verlinkt sie.
Hat dir dieses Briefing gefallen? Erhalte das nächste per Mail.
Mehr in Politik & Sicherheit
OpenAI bekräftigt Zero Data Retention für API-Kunden
Das Unternehmen gab zudem einen Ausblick auf Private Safety Processing für fortgeschrittene KI-Sicherheit bei gleichzeitiger Wahrung des Datenschutzes.
OpenAI bekräftigt Zero Data Retention für Frontier-Modelle
Berechtigte API-Kunden können Zero Data Retention nutzen; Private Safety Processing wurde als Vorschau vorgestellt.
Forscher berichten, OpenAI habe den Zugang zum TAC-Programm entzogen
Cybersecurity-Forscher meldeten, sie hätten den Zugang zu OpenAIs begrenztem Trusted Access for Cyber-Programm verloren.