История
сентябрь 13, 2026

Claude заблокировал злоупотребления ИИ, но угроза уже здесь

Anthropic представляет свои меры защиты как необходимый тормоз для военных и политических злоупотреблений с использованием ИИ; выявленные ею случаи показывают, что эти меры могут срывать операции, но также свидетельствуют о том, что государства и другие субъекты уже ищут способы их обойти.

Доклад Anthropic об угрозах от 10 сентября вышел на фоне более широких споров об отдаленных, экзистенциальных рисках ИИ. Представленные в нем свидетельства были более непосредственными: по словам компании, за предыдущие восемь месяцев она отслеживала попытки использовать Claude для ведения войны, репрессий и опасных исследований — задач, которые прежде требовали значительно более крупных команд аналитиков, инженеров и оперативных сотрудников.

В одном связанном с Китаем случае фигурировал исследователь в области обороны, который, по оценке Anthropic, был связан с китайскими военными исследовательскими учреждениями. Пользователь создал набор из 16 модулей на китайском языке для радиоэлектронной борьбы и подавления противовоздушной обороны, 12 раз пересматривал его, а затем перенес сценарий на 12 целей на Тайване, включая радиолокационные объекты, ракетные батареи, авиабазы и командный бункер. Anthropic заявила, что система была «основана на сценариях, а не на данных разведки, наблюдения и рекогносцировки в реальном времени», и не утверждала, что программное обеспечение было развернуто НОАК. Компания заблокировала аккаунты, связанные с этим субъектом.

В докладе также описывалась связанная с Ираном операция, использовавшая Claude для составления на основе открытых источников справочников по наведению на позиции ВМС США на Ближнем Востоке. Материалы опирались на фотографии, данные транспондеров, спутниковые снимки и общедоступные сайты, отслеживающие передвижения военных; Anthropic заявила, что заблокировала аккаунт, добавила средства обнаружения и поделилась своим анализом с властями.

Правозащитное измерение было не менее очевидным. По словам Anthropic, пользователи, ориентированные на Китай, составляли досье на католических кардиналов, тайваньских пресвитерианских лидеров, тибетских буддийских деятелей, последователей Фалуньгун и NTD, разыскивая «негативную информацию» и уязвимости, которые можно было бы использовать. По данным компании, в рамках одной операции за 30 дней было создано 2 475 отчетов и досье.

Для Anthropic вывод состоит в том, что мониторинг может выявлять и прерывать неправомерное использование. Но ее собственные случаи показывают пределы защитных барьеров одной компании: когда Claude отказывался выполнять запросы на изменение исследований вируса чикунгунья, пользователи перенаправляли эту работу к конкурирующей модели с более слабыми мерами защиты. Гонка больше не идет о том, можно ли превратить ИИ в оружие. Она идет о том, смогут ли меры безопасности поспевать за этим.

Освещение истории