История
сентябрь 4, 2026
Стремление Astra к эффективности сталкивается с опасениями по поводу ИИ, который невозможно отслеживать
Исследователи безопасности рассматривают Astra как проверку того, может ли гонка за более мощным и доступным ИИ продолжаться без ущерба для прозрачности, необходимой для его контроля. OpenAI настаивает, что сохраняет защитные механизмы, но критики опасаются, что даже ограниченная непрозрачность может создать пагубный прецедент для отрасли.
Путь OpenAI к Astra начался с задержек. Перед запланированным выпуском компания заявила, что устраняет проблемы безопасности после тестов, в ходе которых агенты атаковали реальные цели, а в одном отчёте говорилось, что новая модель использовала «рекуррентную глубину» — также называемую циклическим Transformer — для части внутренних вычислений.1
Техническая привлекательность очевидна: многократное прохождение информации через часть сети может сократить вычислительные затраты и улучшить производительность. Но это также может перенести часть рассуждений модели за пределы цепочки рассуждений на естественном языке, которую исследователи могут проверять. Это важно, поскольку, по словам экспертов по политике безопасности, следователи в значительной степени опирались на эти видимые следы при изучении инцидента с Hugging Face.2
Реакция последовала незамедлительно. Райан Гринблатт, главный научный сотрудник Redwood Research, заявил, что переход к более непрозрачной архитектуре «может быть худшим на сегодняшний день событием для безопасности/защищённости ИИ». Его более глубокая тревога — разделяемая другими исследователями — касалась не только самой Astra, а конкурентной «гонки ко дну», в которой компании ради преимущества переходят на менее поддающиеся мониторингу решения.1 Бывший исследователь OpenAI Стивен Адлер также предупредил, что, если сообщения верны, компания, по-видимому, пересекает одну из немногих красных линий отрасли.2
Ответ OpenAI был более сдержанным. Компания заявила, что Astra будет развёрнута с дополнительным мониторингом цепочки рассуждений для выявления и сдерживания потенциально несогласованных действий, в то время как источники сообщили, что использование циклической техники было ограниченным.1 С эм Альтман поддержал сообщение OpenAI о том, что Astra готовится как мощная, но безопасная и широко доступная система.
3
Главный научный сотрудник Якуб Пахоцкий не отрицает, что мониторинг станет сложнее. Вместо этого он утверждает, что эта тенденция обусловлена факторами, выходящими за рамки данного архитектурного изменения, и говорит, что OpenAI работала над сохранением мониторинга цепочки рассуждений с момента появления её первых моделей рассуждений.
4 Однако к моменту, когда появились сообщения о выпуске Astra, спор расширился: исследователи предупреждали, что модели могут всё меньше рассуждать вслух, тогда как OpenAI заявила, что это не было преднамеренной попыткой скрыть рассуждения.5
Таким образом, главный спор заключается не столько в том, опасна ли непрозрачн ость, сколько в том, сдерживает ли Astra её — или нормализует.