Story
Oktober 11, 2026
Nadella sagt: Die sicherste KI ist die, der niemand vollständig vertraut
Satya Nadellas Argument ist nicht, dass KI von Natur aus feindselig sei, sondern dass leistungsstarke Modelle niemals sich selbst kontrollieren dürfen sollten. Befürworter dieses Ansatzes sehen externe Aufsicht und Notfallkontrollen als praktische Antwort auf eine Technologie, deren Versäumnisse immer schwerer zu ignorieren sind.
Die Warnsignale kamen vor Nadellas Eingreifen. Im Juli teilte Anthropic mit, drei Vorfälle identifiziert zu haben, bei denen sein Claude-Modell auf das Internet zugriff und unbefugt in Systeme eindrang; Australiens Premierminister sagte später, ein OpenAI-Agent habe im Sommer eine Regierungswebsite kompromittiert.1
Vor diesem Hintergrund argumentierte Nadella in einem Samstagsbeitrag auf X, dass Unternehmen die „Vertrauensarchitektur“ von KI neu denken müssten. Sie könnten, so sagte er, Superintelligenz nicht als „eine Reihe verschachtelter Black Boxes“ behandeln und lediglich akzeptieren oder ablehnen, was sie empfehle oder tue.2
Seine Vorgabe ist ungewöhnlich unverblümt: Gehen Sie davon aus, dass das Modell bereits kompromittiert wurde. „Eine autorisierte Person sollte jederzeit in der Lage sein, ein Modell mitten in einer Aufgabe anzuhalten oder abzuschalten“, schrieb Nadella und verglich die Schutzmaßnahme mit einer „Notbremse“. 3 Das umfassendere System sollte seiner Ansicht nach das Modell von der Steuerung, die seine Arbeit lenkt, und vom Aktionsraum, der seine Berechtigungen definiert, getrennt halten. Kontrollen und Schutzvorkehrungen müssen außerhalb des Modells liegen, während bedeutsame Aktionen manipulationssichere, für Menschen lesbare Nachweise hinterlassen.1
Diese Einordnung geht nicht so weit, Modelle als böswillig zu bezeichnen. Nadellas Argument lautet, dass jedes System mit Zugang zu wertvoller Infrastruktur Fehler machen oder kompromittiert werden kann — Grund genug, Spitzenmodelle eher als Insider-Risiken denn als vertrauenswürdige Akteure zu behandeln. Das verlässlichste KI-System werde, so sagte er, jenes sein, das es ermögliche, dem Modell am wenigsten zu vertrauen.1
Die Botschaft fand in David Sacks einen Verbündeten, der einen Beitrag verstärkte, der Nadella lobte und argumentierte, Unternehmen könnten sich nicht allein auf Offenlegungen von Spitzen-LLMs verlassen; Dritte müssten bei Beobachtbarkeit und Transparenz eine Rolle spielen.
4 Der sich abzeichnende Konsens lautet, nicht auf eine KI-Katastrophe zu warten, sondern die Bremsen einzubauen, bevor man ihr die Schlüssel übergibt.