Anthropic hat die ersten Claude-Modelle veröffentlicht, die alle Text- und Dateiausgaben mit unsichtbaren Wasserzeichen versehen. Zugleich stellt das Unternehmen eine Schnittstelle bereit, mit der berechtigte Organisationen solche Claude-Wasserzeichen prüfen können.
Claude Fable 5.1 ist in der Claude-Desktop-App und auf weiteren Plattformen allgemein verfügbar. Claude Mythos 5.1 bleibt auf Anthropics Programm für vertrauenswürdige Partner beschränkt. Es richtet sich unter anderem an ausgewählte Projekte in der Cybersicherheit und den Lebenswissenschaften.
Damit wird aus der bisherigen Ankündigung von Wasserzeichen eine konkrete Produktfunktion. Anthropic hatte erklärt, neue Claude-Modelle nach einem festgelegten Stichtag mit Wasserzeichen auszustatten. Fable 5.1 und Mythos 5.1 sind nun die ersten Modelle mit dieser Technik.
Zugang für berechtigte Stellen
Die neue API steht unter anderem Aufsichtsbehörden, Strafverfolgungsbehörden, Medien, Faktenprüfern, unabhängigen Forschern, Bildungseinrichtungen und Teilen der Zivilgesellschaft offen. Auch Unternehmen können Zugang beantragen, wenn sie Wasserzeichen für eigene Compliance-Pflichten prüfen müssen. Anthropic will den Kreis der Zugangsberechtigten nach eigenen Angaben schrittweise erweitern.
Die Schnittstelle reagiert auf Vorgaben des EU AI Act. Das Gesetz sieht Werkzeuge vor, mit denen autorisierte Stellen KI-generierte Inhalte erkennen und überprüfen können. Das ist vor allem für Redaktionen, Forschungseinrichtungen und Organisationen relevant, die die Herkunft von Texten bewerten müssen.
Anthropic zufolge enthalten die Wasserzeichen keine Daten über Nutzer, Organisationen oder Gespräche. Das Verfahren beeinflusst bei der Texterzeugung geringfügig die Wortwahl. Dadurch entsteht ein statistisches Muster, das die API erkennen kann. Laut Anthropic bleibt dieses Muster auch nach dem Kopieren und leichter Bearbeitung teilweise erhalten.
Ein Treffer zeigt, dass Claude den Text erstellt oder verarbeitet hat. Fehlt ein Wasserzeichen, ist das jedoch kein Beleg dafür, dass ein Mensch den Text geschrieben hat. Stärkere Überarbeitungen oder Übersetzungen können die Erkennung beeinträchtigen.
Quellen
- Claude Fable 5.1 and Mythos 5.1 are Anthropic’s first models to watermark text outputs; a detection API is available to eligible groups as required under EU law – PCWorld
- Anthropic opens Claude AI text detection to regulators, media, fact-checkers, and others – The Decoder
Bleib auf dem Laufenden
KI für Contentprofis: die neuesten Tools, Tipps und Trends. Alle 14 Tage in deine Inbox: