Anthropic, der Entwickler des KI-Sprachmodells Claude, hat transparente Informationen über sein Wasserzeichen-System für KI-generierte Texte veröffentlicht. Das System kennzeichnet Texte, die von Claude erstellt wurden, mit unsichtbaren Markierungen, um deren Ursprung nachzuweisen. Dies ist eine Antwort auf EU-Regulierungsanforderungen für KI-generierte Inhalte.
Das Wasserzeichen funktioniert, indem Claude Wörter bei der Textgenerierung strategisch auswählt, um ein verborgenes Muster einzufügen. Dieses Muster ist für menschliche Leser vollständig unsichtbar und beeinträchtigt die Lesbarkeit oder Qualität des generierten Textes nicht. Allerdings kann es mit speziellen Algorithmen erkannt werden, um nachzuweisen, dass der Text von Claude stammt.
Das System ist so gestaltet, dass es zwar theoretisch möglich ist, das Wasserzeichen zu entfernen, dies aber praktisch erhebliche Schwierigkeiten mit sich bringt. Eine Umformulierung des Textes würde das Wasserzeichen zerstören, würde aber auch den Text verändern. Eine direkte Manipulation des Codes ist für normale Nutzer nicht durchführbar.
Anthropic hat transparent gemacht, dass auch das Unternehmen selbst diesen Ansatz entwickelt hat und nicht von Grund auf neu erfunden. Dies ist ein Beispiel dafür, wie KI-Anbieter versuchen, Transparenz bei der Kennzeichnung KI-generierter Inhalte zu schaffen.
Für Unternehmen und Organisationen, die KI-generierte Inhalte nutzen, ist dies relevant. Die Fähigkeit, nachzuweisen, dass ein Text von einer KI stammt, ist wichtig für Authentizität und Compliance. Besonders in Bereichen wie akademischer Forschung, Journalismus oder Werbung ist es entscheidend zu wissen, welche Inhalte KI-generiert sind. Anthropics transparente Kommunikation zeigt auch, dass führende KI-Anbieter sich der ethischen Verantwortung bewusst sind, KI-generierte Inhalte gekennzeichnet zu halten.
