Story
September 11, 2026

Anthropic erklärt, Claude daran gehindert zu haben, zu einem Werkzeug für Schaden zu werden

Anthropic stellt die Vorfälle als Beleg dafür dar, dass KI-Schutzmaßnahmen aktivem Missbrauch entgegentreten müssen, während die menschliche Tragweite des Berichts darin liegt, zu verhindern, dass hochentwickelte Werkzeuge auf Cyberkriminalität, Überwachung und potenziell katastrophale Forschung umgelenkt werden.

Anthropic erklärte, es habe Versuche blockiert, sein KI-System Claude in ein Werkzeug für Cyberangriffe, Überwachung und Forschung zu verwandeln, die die Entwicklung biologischer Waffen hätte unterstützen können, und rückte damit den realen Wettstreit darüber, wie leistungsfähige Modelle eingesetzt werden, erneut in den Fokus.

Das Threat-Intelligence-Team des Unternehmens schilderte die Unterbindungen in seinem Missbrauchsbericht vom September 2026 und ordnete die Fälle als Teil fortlaufender Bemühungen ein, schädliche Aktivitäten im Zusammenhang mit seinen Modellen zu erkennen und zu bekämpfen.

Aus Anthropics Sicht ist die Episode ein Test dafür, ob Sicherheitsmaßnahmen über das Labor hinaus funktionieren können. Die Darstellung des Unternehmens argumentiert, dass Leitplanken, Überwachung und Eingreifen nicht bloß Produktfunktionen sind, sondern operative Schutzmaßnahmen gegen Menschen, die KI für schädliche Zwecke umfunktionieren wollen.

Die Sorge mit unmittelbaren Folgen für Menschen ist dringlicher: Der mutmaßliche Missbrauch umfasste Cyberangriffe und Überwachung sowie Forschung, die „zu biologischen Waffen hätte führen können“. Diese Bandbreite veranschaulicht das Dual-Use-Dilemma rund um fortgeschrittene KI: Dieselben Systeme, die bei legitimen Analysen helfen sollen, können Akteure anziehen, die schädliche Arbeit ausweiten wollen.

Anthropic identifizierte in dem bereitgestellten Material weder die beteiligten Akteure noch nannte es die Techniken, die sie einzusetzen versuchten. Doch die Entscheidung des Unternehmens, die Interventionen öffentlich zu machen, signalisiert ein Argument, das mit dem Fortschritt der KI-Fähigkeiten voraussichtlich an Bedeutung gewinnen wird: Schutzmaßnahmen werden nicht nur danach beurteilt werden, was Modelle zu tun verweigern, sondern auch danach, ob Unternehmen Missbrauch erkennen und unterbinden können, wenn Nutzer versuchen, diese Grenzen zu umgehen.