Anthropic verbietet anhaltendes und grundlos grausames Verhalten gegenüber Claude
TL;DR
Anthropic aktualisiert seine Nutzungsrichtlinien erstmals seit mehr als einem Jahr und nimmt dabei neue Hochrisikofälle wie Wahlbeeinflussung, Waffenentwicklung, Überwachung sowie Anwendungen im Gesundheits- und Finanzbereich auf. Gleichzeitig untersagt das Unternehmen nun ausdrücklich anhaltendes und grundlos grausames oder missbräuchliches Verhalten gegenüber Claude; Gespräche mit dauerhaft schädlichen Nutzern bleiben der wichtigste Durchsetzungsweg.
Nauti's Take
Für Teams mit Claude-Workflows ist die neue Klausel vor allem eine Governance-Frage: Testskripte, Red-Team-Prompts und Support-Automationen sollten klar zwischen harter Prüfung und wiederholter persönlicher Beschimpfung unterscheiden können. Vor einer produktiven Einführung würde ich dokumentieren, wann ein Gespräch automatisch beendet werden darf, welche Ausweichroute Nutzer erhalten und ob Anthropic die Kriterien konsistent genug veröffentlicht, damit Sicherheits- und Qualitätstests reproduzierbar bleiben.