Histoire
octobre 2, 2026
OpenAI affirme avoir stoppé une opération liée à Moonshot visant à copier son raisonnement IA caché
OpenAI présente l’incident comme une menace de sécurité partagée qui pourrait permettre à des concurrents de reproduire des capacités de pointe sans garanties équivalentes, tandis que son attribution reste délibérément plus limitée : elle ne relie qu’un noyau central — et non tous les opérateurs — à des personnes associées à Moonshot AI.
OpenAI affirme que la campagne a commencé discrètement durant la première semaine de juillet, les opérateurs tentant de transformer les traces de travail internes de ses modèles en contenu lisible. L’entreprise qualifie cette technique de « distillation adversariale » : l’utilisation des sorties ou du raisonnement d’un autre modèle pour entraîner, reproduire ou améliorer un système concurrent.1
La distinction est importante. OpenAI affirme que les opérateurs n’ont pas cassé de chiffrement, compromis de bases de données ni accédé à des conversations d’utilisateurs stockées. Ils ont plutôt manipulé les interactions avec les modèles — allant parfois jusqu’à copier le raisonnement chiffré d’une conversation et demander à un modèle dans une autre de le déchiffrer et de le transcrire. Selon OpenAI, il s’agit d’un moyen sérieux de contourner les investissements et les contrôles de sécurité qui sous-tendent les modèles avancés, et non d’une intrusion conventionnelle dans des systèmes.1
L’activité s’est fortement accélérée les 24 et 25 juillet, lorsqu’OpenAI a enregistré 16 000 requêtes présentant un schéma d’extraction provenant de plus de 4 000 utilisateurs. Son enquête ultérieure a relevé une activité de prompts connexe au sein d’un groupe de plus de 15 000 utilisateurs ; au 28 juillet, a-t-elle indiqué, la campagne avait été entièrement perturbée grâce à des restrictions de comptes, des contrôles techniques et une coordination avec des partenaires.1
OpenAI affirme ne pas pouvoir établir que chaque opérateur appartenait à un même acteur. Mais l’entreprise attribue un « noyau central » à des personnes associées à Moonshot AI, le développeur chinois de Kimi. Des articles sur cette allégation ont relevé que Moonshot n’avait pas répondu immédiatement aux demandes de commentaires, laissant l’attribution d’OpenAI sans réponse publique.2
Cette accusation intervient dans le contexte d’un conflit plus large au sein du secteur autour de la copie de modèles. Anthropic avait déjà accusé plusieurs développeurs chinois d’IA, dont Moonshot, d’avoir utilisé Claude pour soutenir leurs efforts d’entraînement ; un autre article a indiqué que l’affirmation d’OpenAI faisait écho à ces accusations antérieures.3 OpenAI a partagé ses conclusions avec le Frontier Model Forum et par l’intermédiaire de canaux gouvernementaux, estimant que la défense contre l’extraction du raisonnement doit être collective à mesure que ces tactiques deviennent moins coûteuses et plus sophistiquées.1