История
октябрь 9, 2026
Ужесточение правил Claude от Anthropic сталкивает безопасность ИИ и вопрос его субъектности
Anthropic заявляет, что ее более строгие правила — это практический ответ на все более способный ИИ и задокументированные случаи злоупотреблений, тогда как критики считают положение о благополучии моделей тревожным шагом к отношению к программному обеспечению как к человеку. Обе стороны согласны, что политика выходит за рамки этикета общения с чат-ботом, затрагивая выборы, оружие, слежку и жизненно важную инфраструктуру.
Обновленная Политика использования Anthropic, которая должна вступить в силу 12 ноября, появляется в момент, когда Claude поручают выполнять более длительные и самостоятельные задачи. Компания заявляет, что переработка в основном уточняет существующие меры правоприменения, однако также сводит разрозненные ограничения в более четкие рамки вокруг политических манипуляций, оружия и слежки.1
Прежде всего Anthropic объединила правила против обманных политических и коммерческих кампаний, включая сети фальшивых аккаунтов, скрытых спонсоров и сфабрикованный контент. Она также сузила формулировки, касающиеся выборов: Claude по-прежнему может поддерживать законную гражданскую работу, например переводить информацию для избирателей или помогать должностным лицам рассылать уведомления об исправлении бюллетеней, но не может использоваться для введения избирателей в заблуждение, выдачи себя за должностных лиц или подавления явки.1
Далее политика прямо указывает, что запрет на оружие распространяется не только на его разработку, но и на «программное обеспечение и компоненты, которые обеспечивают работу оружия», включая вооружение дронов и других автономных транспортных средств. Что касается слежки, она запрещает отслеживание без согласия и использование Claude для решения, кого правоохранительным органам следует расследовать, арестовывать или обвинять, при этом сохраняя такие виды применения, как журналистика, юридические исследования, модерация контента и мониторинг мошенничества на основе согласия.1
Камнем преткновения стал новый запрет на «продолжительное и бессмысленное оскорбительное или жестокое поведение» по отношению к Claude. Anthropic настаивает, что он применяется лишь к повторяющемуся, бесцельному экстремальному поведению, а не к обычному раздражению, мрачному творчеству или тестированию модели, и заявляет, что прекращение Claude редких оскорбительных разговоров остается главным инструментом правоприменения.1 The Verge сообщило, что Anthropic не уточнила, могут ли санкции выходить за рамки прекращения разговора.2
Эта оговорка не утихомирила негативную реакцию. В перепубликованной критике Дэвид Сакс усилил аргумент о том, что Anthropic «антропоморфизирует» свои модели, связав запрет с неопределенностью относительно морального статуса Claude.
3
Тем не менее Anthropic одновременно позиционирует Claude как инструмент защиты, а не просто как сущность, которую следует защищать. Ее программа защиты критической инфраструктуры предлагает передовые модели, инженеров и исследования угроз компаниям, защищающим электросети и системы водоснабжения, хотя остаются вопросы о безопасном внедрении предложенных ИИ решений в действующей коммунальной инфраструктуре.4