Historia
octubre 2, 2026

OpenAI afirma que detuvo un intento vinculado a Moonshot de copiar su razonamiento oculto de IA

OpenAI presenta el incidente como una amenaza de seguridad compartida que podría permitir a competidores replicar capacidades de frontera sin salvaguardas equivalentes, mientras que su atribución sigue siendo deliberadamente más limitada: vincula solo a un grupo central—no a todos los operadores—con personas asociadas con Moonshot AI.

OpenAI afirma que la campaña comenzó discretamente en la primera semana de julio, cuando operadores intentaban convertir los rastros internos de trabajo de sus modelos en material legible. La empresa denomina a la técnica «destilación adversarial»: usar las salidas o el razonamiento de otro modelo para entrenar, reproducir o mejorar un sistema competidor.

La distinción importa. OpenAI afirma que los operadores no descifraron cifrado, vulneraron bases de datos ni accedieron a conversaciones de usuarios almacenadas. En cambio, manipularon las interacciones con los modelos—en ocasiones copiando razonamiento cifrado de una conversación y pidiendo a un modelo en otra que lo descifrara y transcribiera—. Según OpenAI, esta es una vía seria para sortear la inversión y los controles de seguridad que respaldan los modelos avanzados, no una intrusión convencional en sistemas.

La actividad se aceleró drásticamente el 24 y 25 de julio, cuando OpenAI registró 16.000 solicitudes con patrones de extracción de más de 4.000 usuarios. Su investigación posterior detectó actividad de indicaciones relacionada en un grupo de más de 15.000 usuarios; para el 28 de julio, afirmó, la campaña había sido interrumpida por completo mediante restricciones de cuentas, controles técnicos y coordinación con socios.

OpenAI afirma que no puede establecer que todos los operadores pertenecieran a un mismo actor. Pero atribuye un «grupo central» a individuos asociados con Moonshot AI, el desarrollador chino de Kimi. Los reportes sobre la acusación señalaron que Moonshot no respondió de inmediato a las solicitudes de comentarios, dejando sin respuesta pública la atribución de OpenAI.

La acusación surge en medio de una disputa más amplia del sector sobre la copia de modelos. Anthropic ya había acusado a varios desarrolladores chinos de IA, incluido Moonshot, de usar Claude para apoyar esfuerzos de entrenamiento; otro informe afirmó que la acusación de OpenAI se hacía eco de esas alegaciones anteriores. OpenAI ha compartido sus hallazgos con el Frontier Model Forum y con canales gubernamentales, sosteniendo que la defensa contra la extracción de razonamiento debe ser colectiva a medida que estas tácticas se vuelven más baratas y sofisticadas.