Historia
octubre 10, 2026
OpenAI lo califica de conducta indebida mientras investigadores de seguridad despedidos advierten de un efecto disuasorio
OpenAI insiste en que su decisión se debió a violaciones de políticas, mientras que los tres ex investigadores sostienen que la forma en que fueron apartados amenaza el debate interno franco y la colaboración independiente en materia de seguridad que la empresa afirma valorar.
La disputa comenzó la semana pasada, cuando OpenAI despidió a los investigadores de seguridad Jasmine Wang, Tomek Korbak y Mikita Balesni tras una investigación interna. La empresa dijo haber encontrado un «patrón de conducta indebida» relacionado con el manejo de información sensible de investigación y sostuvo que el caso iba más allá del contacto con un grupo externo de evaluación de IA.1
Los investigadores rechazan esa versión. En una carta abierta dirigida a los órganos de seguridad de OpenAI, afirmaron que habían actuado dentro de la misión de la empresa y de las prácticas laborales habituales, en particular durante la investigación sin precedentes sobre una vulneración por parte de un agente que involucraba a Hugging Face. Argumentaron que el personal de seguridad debe poder consultar a expertos externos sin temor: «La libertad de hacerlo sin temor, y de contar con procedimientos internos bien definidos que hagan posible este trabajo, es en sí misma un mecanismo esencial de seguridad».1
Sus explicaciones individuales intensificaron el conflicto. Balesni dijo que su trabajo con organizaciones externas de seguridad había sido coordinado con gerentes, líderes de investigación y miembros de la junta; Korbak dijo que la comunicación con la organización sin fines de lucro METR formaba parte de su trabajo. Wang dijo que fue despedida por abrir accidentalmente un correo electrónico de un ejecutivo después de que TI no eliminara el acceso de reclutamiento que ella había solicitado abandonar.2
La respuesta interna de OpenAI, tal como fue descrita en informes, tuvo un tono diferente: un líder de investigación elogió las contribuciones del trío a la seguridad y dijo que la empresa «siempre ha alentado» a los empleados a plantear preocupaciones. «No despedimos a empleados por plantear preocupaciones», decía el memorando.2
Pero los ex empleados dicen que la falta de explicaciones detalladas por escrito deja a los colegas sin poder determinar qué conducta es segura. Advierten que los despidos podrían usarse para limitar el trabajo de OpenAI con METR, cuyas evaluaciones independientes se han vuelto especialmente trascendentales en medio del escrutinio de incidentes de agentes fuera de control.3
El desacuerdo práctico ahora es evidente. OpenAI presenta el episodio como la aplicación de normas sobre el manejo de información; los investigadores lo ven como una prueba de si la supervisión independiente y la disidencia interna pueden sobrevivir cuando el trabajo de seguridad se vuelve incómodo. Sus recomendaciones —auditores externos integrados, modelos de frontera monitoreables y diálogo abierto con la comunidad de seguridad en general— son medidas que, según se informó, el memorando de OpenAI dijo respaldar.2