Anthropic, einer der führenden Entwickler von Sprachmodellen, weitet die Verwendung von unsichtbaren Wasserzeichen auf weitere Versionen seines Claude-KI-Systems aus. Diese technische Massnahme zielt darauf ab, Texte, die von Claude erstellt wurden, eindeutig als KI-generiert zu kennzeichnen. Das Wasserzeichen ist für menschliche Leser unsichtbar, kann aber durch technische Analyse erkannt werden.

Das Verfahren funktioniert, indem statistische Muster in den generierten Texten eingebettet werden, die charakteristisch für Claude sind. Nutzer können damit prüfen, ob ein vorliegender Text tatsächlich von Anthropics KI stammt oder von anderer Seite. Dies soll besonders im Kampf gegen Desinformation und gegen unberechtigt verwendete KI-Inhalte helfen.

Die Massnahme adressiert ein wachsendes Problem in der digitalen Welt. Während KI-Systeme immer bessere und überzeugendere Texte produzieren, wird es zugleich schwieriger, diese von menschlich verfassten Inhalten zu unterscheiden. Das kann zu Missbrauch führen, wenn Texte ohne Kennzeichnung als authentisch menschliche Arbeiten ausgegeben werden.

Allerdings hat die Technologie praktische Grenzen. Das Wasserzeichen bleibt nur gültig, wenn der Text nicht nachträglich bearbeitet oder paraphrasiert wird. Sobald ein generierter Text redaktionell überarbeitet wird, kann das digitale Merkmal verloren gehen oder undeutlich werden. Zudem funktioniert die Erkennung nur, wenn Leser Zugang zu den entsprechenden Erkennungswerkzeugen haben.

Für Unternehmen und IT-Verantwortliche ist dies relevant, weil es Chancen und Risiken beim Einsatz von KI-Systemen beeinflusst. Einerseits bietet die Wasserzei­chen-Technologie einen Schutzmechanismus gegen unerlaubte KI-Nutzung. Andererseits zeigt sie auch auf, dass vollständige Transparenz und sichere Kontrolle über KI-generierte Inhalte schwierig bleibt. Organisationen sollten daher klare Richtlinien für die Verwendung von KI-Tools etablieren und ihre Mitarbeiter entsprechend schulen.