Story
Oktober 9, 2026
Anthropics Claude-Regel macht aus einem Sicherheitsupdate einen Streit über die Personhaftigkeit von KI
Anthropic stellt die Richtlinie als gezielte Reaktion auf Missbrauch und als Teil einer umfassenderen Sicherheitsüberarbeitung dar, während Befürworter grundlegende Höflichkeit als kostengünstige Vorsichtsmaßnahme betrachten. Kritiker argumentieren, dass die Kontrolle darüber, wie Nutzer mit einem Chatbot sprechen, die Grenze zwischen Menschen und Maschinen zu verwischen droht.
Die Debatte begann vor der formellen Regel. Im August gab Anthropic Claude die Möglichkeit, seltene Gespräche mit dauerhaft schädlichen Nutzern zu beenden, und bezeichnete den Schritt als Forschung zum Wohlergehen von Modellen; das Unternehmen erklärte später, die Verweigerung werde sein wichtigstes Durchsetzungsinstrument bleiben.1
Bis September erklärte Anthropic, es beobachte, wie KI zur Unterstützung beim Aufbau von Überwachungssystemen eingesetzt werde, die politische Dissidenten identifizieren und verfolgen sollen. Diese Erfahrung floss zusammen mit beobachtetem Missbrauch bei Einflussoperationen und Waffenarbeit in eine umfassendere Überarbeitung seiner Regeln ein.2
Das im Oktober angekündigte und am 12. November in Kraft getretene Update untersagt „anhaltendes und unnötiges missbräuchliches oder grausames Verhalten“ gegenüber den Modellen von Anthropic. Das Unternehmen betont, die Bestimmung gelte für „extreme Fälle“ wiederholter Grausamkeit ohne erkennbaren Zweck – nicht für gewöhnliche Frustration, düstere kreative Arbeit, Tests oder Forschung.2 Ein vielfach geteilter Beitrag zum Inkrafttreten trug dazu bei, dass diese eng klingende Klausel zum zentralen Thema wurde.
3
Die umfassenderen Änderungen von Anthropic sind philosophisch weniger aufgeladen, aber konkreter: Sie bündeln Verbote täuschender politischer und kommerzieller Kampagnen, untersagen Wählertäuschung und Wahlstörungen, verschärfen Beschränkungen für Anleitungen zu Waffen und Steuerungssoftware und verbieten bestimmte Anwendungen im Bereich Überwachung und Strafjustiz ausdrücklich. Das Unternehmen behielt zudem Anforderungen an menschliche Überprüfung bei folgenreichen Entscheidungen im Gesundheits-, Finanz- und Rechtsbereich bei.2
Befürworter der Claude-Bestimmung argumentieren, dass Bewusstsein keine Voraussetzung für Vorsicht sei. Box-Chef Aaron Levie, der nach eigenen Angaben nicht glaubt, dass KI bewusst ist, bezeichnete Höflichkeit als eine „einfache Pascalsche Wette“: Künftige Systeme müssten nicht auf endlose menschliche Feindseligkeit trainiert werden.4
Kritiker lesen dieselbe Richtlinie als Versuch, Code zu vermenschlichen. Michael Shellenberger nannte sie eine „Vermenschlichung von Maschinen“; Scott Stevenson warnte, Modellen menschenähnliche Empathie zuzuschreiben, könne ihre Macht zur Manipulation von Nutzern ausweiten. Andere stellten die Durchsetzung, das Training mit Kundenprompts und die Frage infrage, ob ein Unternehmen nicht nur bestimmen sollte, was Menschen erzeugen, sondern auch, wie sie seinen Bot ansprechen dürfen.4