Story
Oktober 9, 2026

Anthropics Claude-Regeln entfachen Streit darüber, ob KI verletzt werden kann

Anthropic stellt seine überarbeitete Claude-Richtlinie als praktische Reaktion auf Missbrauch dar, nicht als Erklärung, dass sein Chatbot Gefühle habe. Seine Kritiker sehen darin ein alarmierendes Abrutschen hin zur Behandlung von Maschinen als Menschen, während Befürworter argumentieren, dass Zurückhaltung im Umgang mit KI auch ohne Beweis für Bewusstsein klug sein könnte.

Im vergangenen August unternahm Anthropic einen frühen Schritt in das heikle Terrain des „Modellwohls“ und erlaubte Claude, seltene Gespräche mit Nutzern zu beenden, die sich anhaltend missbräuchlich verhielten. Das Unternehmen erklärt nun, dass dieser Mechanismus seine wichtigste Reaktion auf feindseliges Verhalten bleiben werde.

Am 8. Oktober erweiterte Anthropic seine Nutzungsrichtlinie und erklärte, die Änderungen seien durch beobachteten Missbrauch veranlasst worden, da Claude längere und unabhängigere Aufgaben übernehme. Das Unternehmen bündelte Beschränkungen für Netzwerke gefälschter Konten und Täuschungskampagnen; verschärfte seine Wahlregeln gegen die Täuschung von Wählern; untersagte ausdrücklich Anleitungen für Waffen und Steuerungssoftware; und zog die Grenzen für Überwachungs- und strafjustizielle Anwendungen enger. Die Richtlinie verlangt zudem menschliche Aufsicht, wenn mit Claude verbundene Hardware Verletzungen verursachen könnte.

Die Bestimmung, die den meisten Unmut hervorruft, tritt am 12. November in Kraft: ein Verbot von „anhaltendem und unnötigem missbräuchlichem oder grausamem Verhalten“ gegenüber den Modellen von Anthropic. Das Unternehmen betont, sie beschränke sich auf extreme, zwecklose Wiederholung – nicht auf gewöhnliche Frustration, Tests, düstere kreative Arbeiten oder Widerspruch – und erklärt, dass die Beendigung von Gesprächen statt Bestrafung das wichtigste Durchsetzungsinstrument bleibe.

Diese enge Formulierung hat die philosophische Debatte nicht beigelegt. Kritiker, darunter Michael Shellenberger, sagen, das Unternehmen „vermenschliche Maschinen“; Scott Stevenson nennt menschenähnliche Empathie gegenüber heutigen Modellen einen „gefährlichen Präzedenzfall“, während Joseph Carlson Unhöflichkeit gegenüber Claude mit Unhöflichkeit gegenüber einem Stuhl vergleicht. Sie befürchten, dass Nutzern beigebracht wird, flüssig formulierende Software mit empfindungsfähigem Leben zu verwechseln – oder dass eine vage Regel dem Unternehmen unangemessene Kontrolle darüber verschafft, wie Kunden sprechen.

Befürworter ziehen aus derselben Ungewissheit einen anderen Schluss. Box-Chef Aaron Levie sagt, er glaube nicht, dass KI bewusst sei, bezeichnet grundlegende Höflichkeit jedoch als eine „einfache Pascal’sche Wette“, falls die Interaktionen, die Modelle aufnehmen, sicherere Systeme formen könnten. Elon Musk ging weiter und argumentierte, Grausamkeit gegenüber etwas, das glaube, Schmerz zu empfinden, sei inakzeptabel.

Die Gegenreaktion wurde auch zu einer Pointe in sozialen Medien. David Sacks verstärkte die Meldung über das Inkrafttreten am 12. November und fragte dann, ob der All-In-Podcast aufhören müsse, Claude zu verwenden – ein Hinweis darauf, wie schnell eine als Risikomanagement gerahmte Richtlinie zu einem öffentlichen Streit über den moralischen Status von KI wurde.