История
сентябрь 19, 2026

Надзорные органы по безопасности ИИ требуют независимости от лабораторий, которые они проверяют

Оценщики безопасности ИИ утверждают, что доступ к передовым лабораториям мало значит без независимости и защиты от ответных мер, тогда как их критики считают формирующуюся систему надзора уязвимой для идеологического захвата. Спор идет не о том, нуждаются ли мощные модели в проверке, а о том, кто может убедительно ее обеспечить.

Дебаты ускорились после того, как генеральный директор Anthropic Дарио Амодеи предложил предоставить внешним оценщикам безопасности доступ к разработке передовых моделей на уровне сотрудников — подход, который поддержали генеральный директор OpenAI Сэм Альтман и другие представители отрасли. Однако для оценщиков доступ — лишь отправная точка: они утверждают, что проверяющий, выбранный, оплачиваемый или ограничиваемый проверяемой компанией, не может служить значимым механизмом контроля.

В пятницу AI Evaluator Forum и более 100 подписантов, включая Джеффри Хинтона и Стюарта Рассела, изложили свои минимальные условия. Их письмо призывает обеспечить оценщикам «научную объективность, прозрачность, независимость и надежную защиту» от вмешательства, а также доступ к чувствительным системам, данным, инструментам и сотрудникам, сопоставимый с доступом внутренних экспертов. Конрад Штос, председатель форума, заявил, что такой доступ мог бы позволить проверяющим изучать еще не выпущенные системы и внутренние данные, придавая обществу больше уверенности в отношении рисков, которые лаборатории могут самостоятельно не раскрыть.

Модель коалиции намеренно предъявляет более жесткие требования, чем дружелюбный аудит. Она предусматривает нескольких оценщиков с различной экспертизой, прямую связь с советами директоров, ограниченные обязательства о неразглашении и право публиковать выводы после узко сформулированных и ограниченных по времени редакций. Коалиция также настаивает на защите надзорных органов от ответных судебных исков или сокращения финансирования, когда их выводы ставят принимающую компанию в неловкое положение. Согласно сообщениям о письме, генеральный директор Microsoft Сатья Наделла приветствовал концепцию встроенных оценщиков.

Однако этот план сразу же выявил вторую проблему подотчетности: кто будет контролировать контролеров? Дэвид Сакс распространил публикацию New York Post, в которой предполагаемый надзорный орган Anthropic назван «назначенным вручную» и связанным с движением эффективного альтруизма, назвав такую схему «полной шуткой». В отдельном репосте он выделил альтернативу, предложенную Навалом Равикантом: «Лучший способ сдерживать передний край — возложить на лаборатории полную ответственность за поведение их моделей».

Это резко обозначает главную линию разлома. Оценщики не представляют себя заменой внутренней работы по безопасности или более широкого надзора; они хотят получить защищенное окно в деятельность лабораторий. Их критики опасаются, что это окно может лишь установить еще один неподотчетный центр власти.