Notícia
outubro 2, 2026
OpenAI afirma que interrompeu uma iniciativa ligada à Moonshot para copiar seu raciocínio oculto de IA
A OpenAI apresenta o incidente como uma ameaça compartilhada à segurança que poderia permitir que concorrentes replicassem capacidades de ponta sem salvaguardas equivalentes, enquanto sua atribuição permanece deliberadamente mais restrita: ela vincula apenas um grupo central — e não todos os operadores — a pessoas associadas à Moonshot AI.
A OpenAI afirma que a campanha começou discretamente na primeira semana de julho, com operadores tentando transformar os rastros internos de trabalho de seus modelos em material legível. A empresa chama a técnica de “destilação adversarial”: usar as saídas ou o raciocínio de outro modelo para treinar, reproduzir ou aprimorar um sistema concorrente.1
A distinção é importante. A OpenAI afirma que os operadores não quebraram criptografia, violaram bancos de dados nem acessaram conversas de usuários armazenadas. Em vez disso, manipularam interações com os modelos — às vezes copiando raciocínio criptografado de uma conversa e pedindo a um modelo em outra para descriptografá-lo e transcrevê-lo. Na visão da OpenAI, isso é uma rota séria para contornar os investimentos e controles de segurança por trás de modelos avançados, e não uma invasão convencional de sistemas.1
A atividade acelerou acentuadamente em 24 e 25 de julho, quando a OpenAI registrou 16.000 solicitações com padrão de extração de mais de 4.000 usuários. Sua investigação subsequente encontrou atividade relacionada de prompts em um grupo de mais de 15.000 usuários; até 28 de julho, afirmou, a campanha havia sido totalmente interrompida por meio de restrições de contas, controles técnicos e coordenação com parceiros.1
A OpenAI afirma que não pode estabelecer que todos os operadores pertenciam a um único agente. Mas atribui um “grupo central” a indivíduos associados à Moonshot AI, desenvolvedora chinesa do Kimi. Reportagens sobre a alegação observaram que a Moonshot não respondeu imediatamente aos pedidos de comentário, deixando a atribuição da OpenAI sem resposta pública.2
A acusação surge em meio a uma disputa mais ampla no setor sobre cópia de modelos. A Anthropic já havia acusado vários desenvolvedores chineses de IA, incluindo a Moonshot, de usar o Claude para auxiliar esforços de treinamento; outra reportagem afirmou que a alegação da OpenAI ecoou essas acusações anteriores.3 A OpenAI compartilhou suas conclusões com o Frontier Model Forum e canais governamentais, argumentando que a defesa contra a extração de raciocínio deve ser coletiva à medida que tais táticas se tornam mais baratas e sofisticadas.1