Historia
septiembre 20, 2026

Anthropic abre su sistema de seguridad a Accenture, pero paga por la auditoría

Anthropic considera que los evaluadores integrados son una forma práctica de hacer verificables desde dentro del laboratorio las promesas de seguridad de la IA, mientras que la preocupación central de los críticos sigue incorporada en el piloto: la empresa sometida a escrutinio está pagando por ese escrutinio.

Anthropic ha dado su primer paso concreto hacia el desarrollo de IA de frontera más lento y más estrechamente supervisado que defiende su director ejecutivo, Dario Amodei: incorporar a Accenture dentro de la empresa para evaluar sus modelos más potentes.

La asociación, liderada por Faculty, la unidad especializada en IA de Accenture, incluirá pruebas de red-teaming de modelos, evaluación de la alineación y pruebas de salvaguardas. A diferencia de los revisores externos convencionales, los evaluadores integrados recibirán acceso comparable al de un empleado de Anthropic, suficiente para observar el entrenamiento, rastrear decisiones sobre desarrollo y despliegue, y hablar directamente con el personal. Anthropic sostiene que la proximidad es precisamente el objetivo: puede exponer puntos ciegos y permitir a los revisores informar sobre incidentes desde una perspectiva informada. «Los evaluadores integrados independientes no reducen nuestra rendición de cuentas, sino que ayudan a hacerla más verificable», afirmó la empresa.

El anuncio sigue al llamamiento de Amodei para que los desarrolladores de IA sometan sus prácticas de seguridad al examen de terceros a medida que los modelos se vuelven más capaces. Anthropic afirma que sigue siendo responsable de la seguridad de sus sistemas y que pretende trabajar con múltiples evaluadores, incluida la organización sin fines de lucro METR. El papel de Accenture es explícitamente no exclusivo, y la consultora puede asumir trabajos similares para otros desarrolladores de IA.

Pero el experimento también deja al descubierto la brecha de gobernanza que pretende abordar. Anthropic y Accenture esperan invertir cada una al menos 1.000 millones de dólares durante cinco años para desarrollar capacidad de evaluación; sin embargo, Anthropic financiará directamente el trabajo de Accenture porque actualmente no existe ningún mecanismo de financiación conjunta ni respaldado por el gobierno. La empresa afirma que las normas tampoco están definidas: no hay un conjunto de reglas acordado sobre qué acceso deberían recibir los evaluadores ni sobre cómo deberían divulgar sus hallazgos.

Eso hace que el piloto transmita dos mensajes a la vez. Es una concesión notable a una supervisión más profunda en un laboratorio de frontera; también es un modelo de auditoría cuya independencia aún no se ha garantizado estructuralmente. Como lo expresó un informe, Anthropic seleccionó a Accenture para «supervisar internamente la seguridad de sus herramientas de IA» tras el compromiso de supervisión de su CEO.