История
октябрь 9, 2026

Правило Anthropic для Claude превратило обновление безопасности в спор о личности ИИ

Anthropic представляет эту политику как узконаправленную реакцию на злоупотребления и часть более масштабного пересмотра мер безопасности, тогда как сторонники считают базовую вежливость недорогой мерой предосторожности. Критики утверждают, что контроль за тем, как пользователи разговаривают с чат-ботом, грозит размыть границу между людьми и машинами.

Спор начался ещё до формального правила. В августе Anthropic дала Claude возможность завершать редкие разговоры с пользователями, которые постоянно причиняют вред, представив этот шаг как исследование благополучия моделей; позднее компания заявила, что главным инструментом правоприменения останется отказ.

К сентябрю Anthropic сообщила, что ИИ используется для помощи в создании систем слежки, предназначенных для выявления и отслеживания политических диссидентов. Этот опыт, наряду с наблюдаемыми злоупотреблениями в операциях влияния и работе с оружием, послужил основой для более масштабного пересмотра её правил.

Обновление, объявленное в октябре и вступившее в силу 12 ноября, запрещает «продолжительное и беспричинное оскорбительное или жестокое поведение» в отношении моделей Anthropic. Компания настаивает, что это положение предназначено для «крайних случаев» повторяющейся жестокости без ясной цели, а не для обычного раздражения, мрачного творчества, тестирования или исследований. Широко распространённый пост, отметивший дату вступления изменений в силу, помог превратить этот узко сформулированный пункт в главную тему.

Более широкие изменения Anthropic менее философски нагружены, но более конкретны: они объединяют запреты на вводящие в заблуждение политические и коммерческие кампании, запрещают обман избирателей и срыв выборов, ужесточают ограничения на инструкции по созданию оружия и программное обеспечение для его управления, а также более прямо запрещают некоторые виды использования в сфере слежки и уголовного правосудия. Компания также сохранила требования о проверке человеком значимых решений в области здравоохранения, финансов и права.

Сторонники положения о Claude утверждают, что для осторожности не требуется сознание. Генеральный директор Box Аарон Леви, который говорит, что не считает ИИ сознательным, назвал вежливость «простым пари Паскаля»: будущие системы не следует обучать на бесконечной человеческой враждебности.

Критики расценивают ту же политику как попытку очеловечить код. Майкл Шелленбергер назвал это «антропоморфизацией машин»; Скотт Стивенсон предупредил, что наделение моделей человекоподобной эмпатией может расширить их возможности манипулировать пользователями. Другие поставили под вопрос правоприменение, обучение на клиентских запросах и то, должна ли компания диктовать не только то, что люди создают, но и то, как им разрешено обращаться к её боту.