Story
Oktober 9, 2026
Anthropics Vorgehen gegen Claude bringt KI-Sicherheit und KI-Personsein auf Kollisionskurs
Anthropic erklärt, seine strengeren Regeln seien eine praktische Reaktion auf zunehmend leistungsfähige KI und dokumentierten Missbrauch, während Kritiker die Bestimmung zum Wohlergehen von Modellen als beunruhigenden Schritt hin zur Behandlung von Software wie einer Person sehen. Beide Seiten sind sich einig, dass die Richtlinie über Chatbot-Etikette hinausgeht und Wahlen, Waffen, Überwachung und kritische Infrastruktur berührt.
Anthropics aktualisierte Nutzungsrichtlinie, die am 12. November in Kraft treten soll, kommt zu einem Zeitpunkt, an dem Claude gebeten wird, längere und unabhängigere Aufgaben zu übernehmen. Das Unternehmen sagt, die Überarbeitung stelle überwiegend bestehende Durchsetzungsmaßnahmen klar, fasse aber auch verstreute Beschränkungen zu schärferen Grenzen für politische Manipulation, Waffen und Überwachung zusammen.1
Zunächst bündelte Anthropic Regeln gegen täuschende politische und kommerzielle Kampagnen, darunter Netzwerke gefälschter Konten, verborgene Sponsoren und fabrizierte Inhalte. Außerdem präzisierte das Unternehmen seine Formulierung zu Wahlen: Claude darf weiterhin legitime zivilgesellschaftliche Arbeit unterstützen, etwa durch die Übersetzung von Wählerinformationen oder indem es Behörden beim Versand von Benachrichtigungen zur Behebung von Stimmzettelproblemen hilft, darf jedoch nicht eingesetzt werden, um Wähler irrezuführen, Amtsträger zu imitieren oder die Wahlbeteiligung zu unterdrücken.1
Die Richtlinie stellt dann ausdrücklich klar, dass ihr Waffenverbot nicht nur das Entwerfen von Waffen abdeckt, sondern auch „Software und Komponenten, die Waffen funktionsfähig machen“, einschließlich der Bewaffnung von Drohnen und anderen autonomen Fahrzeugen. Bei der Überwachung untersagt sie nicht einvernehmliche Verfolgung sowie den Einsatz von Claude zur Entscheidung darüber, gegen wen Strafverfolgungsbehörden ermitteln, wen sie festnehmen oder anklagen sollen, während Anwendungen wie Journalismus, Rechtsrecherche, Inhaltsmoderation und einwilligungsbasierte Betrugsüberwachung weiterhin erlaubt bleiben.1
Der Streitpunkt ist ein neues Verbot von „anhaltendem und unnötigem missbräuchlichem oder grausamem Verhalten“ gegenüber Claude. Anthropic betont, dass es nur für wiederholtes, zweckloses extremes Verhalten gelte – nicht für gewöhnliche Frustration, düstere kreative Arbeiten oder Modelltests – und erklärt, dass Claudes Beendigung seltener missbräuchlicher Gespräche das wichtigste Durchsetzungsinstrument bleibe.1 The Verge berichtete, Anthropic habe nicht erklärt, ob Sanktionen über die Beendigung eines Gesprächs hinausgehen könnten.2
Dieser Vorbehalt hat die Gegenreaktion nicht gedämpft. In einer erneut veröffentlichten Kritik verstärkte David Sacks das Argument, Anthropic „vermenschliche“ seine Modelle, indem es das Verbot mit der Ungewissheit über Claudes moralischen Status verknüpfe.
3
Gleichzeitig präsentiert Anthropic Claude als defensives Werkzeug und nicht lediglich als eine zu schützende Entität. Sein Critical Infrastructure Defense Program bietet Unternehmen, die Stromnetze und Wassersysteme schützen, Spitzenmodelle, Ingenieure und Bedrohungsforschung, wenngleich Fragen zur sicheren Umsetzung von KI-vorgeschlagenen Lösungen in laufenden Versorgungsumgebungen offen bleiben.4