Story
Oktober 2, 2026

OpenAI erklärt, einen mit Moonshot verknüpften Versuch zum Kopieren seines verborgenen KI-Schlussfolgerns gestoppt zu haben

OpenAI stellt den Vorfall als gemeinsame Sicherheitsbedrohung dar, die es Wettbewerbern ermöglichen könnte, Spitzenfähigkeiten ohne gleichwertige Schutzvorkehrungen nachzubilden, während seine Zuschreibung bewusst enger gefasst bleibt: Es verknüpft nur ein Kerncluster – nicht jeden Akteur – mit Personen, die mit Moonshot AI assoziiert sind.

OpenAI erklärt, die Kampagne habe in der ersten Juliwoche unauffällig begonnen; die Akteure hätten versucht, die internen Arbeitsspuren seiner Modelle in lesbares Material zu verwandeln. Das Unternehmen bezeichnet die Technik als „adversarial distillation“: die Nutzung der Ausgaben oder Schlussfolgerungen eines anderen Modells, um ein konkurrierendes System zu trainieren, nachzubilden oder zu verbessern.

Die Unterscheidung ist wichtig. OpenAI erklärt, die Akteure hätten weder Verschlüsselung geknackt noch Datenbanken kompromittiert oder auf gespeicherte Nutzergespräche zugegriffen. Stattdessen manipulierten sie Modellinteraktionen – teils indem sie verschlüsselte Schlussfolgerungen aus einem Gespräch kopierten und ein Modell in einem anderen Gespräch baten, diese zu entschlüsseln und zu transkribieren. Nach Auffassung von OpenAI ist dies ein schwerwiegender Weg, die Investitionen und Sicherheitskontrollen hinter fortschrittlichen Modellen zu umgehen, und kein herkömmlicher Systemeinbruch.

Die Aktivität nahm am 24. und 25. Juli stark zu, als OpenAI 16.000 Anfragen mit Extraktionsmustern von mehr als 4.000 Nutzern verzeichnete. Seine anschließende Untersuchung ergab verwandte Prompt-Aktivitäten in einem Cluster von mehr als 15.000 Nutzern; bis zum 28. Juli sei die Kampagne durch Kontobeschränkungen, technische Kontrollen und die Koordinierung mit Partnern vollständig unterbunden worden.

OpenAI erklärt, es könne nicht feststellen, dass jeder Akteur zu einem einzigen Akteur gehörte. Es schreibt jedoch ein „Kerncluster“ Personen zu, die mit Moonshot AI, dem chinesischen Entwickler von Kimi, assoziiert sind. Berichte über den Vorwurf merkten an, dass Moonshot auf Anfragen zur Stellungnahme nicht umgehend reagiert habe, wodurch die Zuschreibung von OpenAI öffentlich unbeantwortet blieb.

Der Vorwurf erfolgt inmitten eines breiteren Branchenstreits über das Kopieren von Modellen. Anthropic hatte bereits mehrere chinesische KI-Entwickler, darunter Moonshot, beschuldigt, Claude zur Unterstützung von Trainingsbemühungen genutzt zu haben; ein weiterer Bericht erklärte, OpenAIs Behauptung erinnere an diese früheren Vorwürfe. OpenAI hat seine Erkenntnisse mit dem Frontier Model Forum und Regierungsstellen geteilt und argumentiert, dass die Abwehr gegen die Extraktion von Schlussfolgerungen gemeinschaftlich erfolgen müsse, da solche Taktiken billiger und ausgefeilter würden.