История
сентябрь 19, 2026

План Anthropic по безопасности стоимостью $1 млрд проходит проверку на независимость

Anthropic представляет встроенную оценку как практический способ проверить, соблюдают ли компании, работающие с передовым ИИ, свои обязательства по безопасности; скептики утверждают, что включение крупной консалтинговой фирмы в штат компании делает независимость главным вопросом без ответа.

Anthropic переводит предложенную ею модель надзора за передовым ИИ из теории в практический эксперимент, назначив Accenture своим первым встроенным оценщиком. Компания и консалтинговая фирма рассчитывают инвестировать не менее $1 млрд в течение пяти лет для наращивания потенциала оценки, при этом работой будет руководить специализированное ИИ-подразделение Accenture — Faculty.

Эта схема призвана пойти дальше традиционных внешних аудитов. Anthropic заявляет, что встроенные оценщики будут работать внутри ИИ-компаний с доступом, сопоставимым с доступом сотрудников: наблюдать за разработкой моделей в ходе обучения, отслеживать решения на протяжении внедрения, напрямую общаться с персоналом и оценивать, выполняются ли обязательства по безопасности. Ожидается, что Accenture будет проводить ред-тиминг моделей, оценки согласованности и тестирование защитных механизмов, используя при этом свой опыт в том, как бизнес и правительства применяют ИИ.

Anthropic утверждает, что близость может усилить контроль, а не ослабить его. «Независимые встроенные оценщики не уменьшают нашу подотчётность, а помогают сделать её более проверяемой», — заявила компания, подчеркнув, что окончательная ответственность за безопасность моделей остаётся за Anthropic.

Однако это объявление также выявляет слабые места этой формирующейся модели надзора. Устоявшихся стандартов для доступа, отчётности или финансирования оценщиков нет, и Anthropic будет напрямую оплачивать работу Accenture, поскольку объединённого или поддерживаемого государством финансирования пока не существует. Компания сообщает, что ведёт переговоры с METR и другими некоммерческими оценщиками, надеется со временем работать с несколькими группами и называет партнёрство с Accenture неисключительным.

Скептическая реакция сводится к одному прямому вопросу: «Первый встроенный оценщик Anthropic — это ... Accenture?» Такая постановка вопроса не оспаривает необходимость строгого тестирования. Она ставит под сомнение, может ли консалтинговая фирма, которой платит проверяемая ею лаборатория, обеспечить независимость, которую обещает этот эксперимент. Следующий выбор оценщиков Anthropic — и правила, определяющие, что Accenture может раскрывать, — определят, станет ли это заслуживающим доверия шаблоном безопасности или изощрённой формой самоконтроля.