История
август 15, 2026

Невидимый водяной знак Claude обещает прозрачность, но размывает, кто на самом деле написал текст

Anthropic будет помечать будущую выдачу Claude водяным знаком в соответствии с правилами прозрачности ЕС, но ограничения самой системы усилили опасения, что лёгкое редактирование человеком может быть ошибочно принято за авторство ИИ.

Ответ Anthropic на проблему авторства ИИ — это невидимая метка, которая следует за словами Claude. Осложнение столь же невидимо: результат обнаружения может показать участие ИИ, не устанавливая, кто на самом деле написал работу.

Переход связан с обязательствами по прозрачности в рамках Акта ЕС об ИИ, вступившими в силу 2 августа. Anthropic заявила, что будущие модели Claude будут помечать сгенерированный текст и поддерживаемые файлы по всему миру: в текст будут встраиваться водяные знаки, а файлы получат подписанные метаданные происхождения; более старые модели всё ещё приводятся в соответствие с требованиями.

Компания говорит, что сигнал в тексте — это не скрытый символ и не видимый тег. Вместо этого он использует малозначимые варианты слов, создавая статистический шаблон на основе версии подхода SynthID-Text от Google DeepMind. Anthropic утверждает, что результат не имеет «практического влияния на качество или содержание» ответов Claude и может лишь указать на вероятность того, что Claude был задействован.

Именно это различие стало линией разлома. В сообщениях о запуске отмечалось, что документ может нести метку после того, как Claude лишь вычитал, отформатировал или перевёл написанный человеком текст, — в то время как при сильной переработке, смешении с другими источниками или в очень коротких отрывках сигнал может полностью стать недетектируемым. Anthropic говорит, что при лёгких правках, ограниченных грамматикой, обычно остаётся слишком мало текста, выбранного Claude, для надёжного обнаружения, но критики опасаются, что получатели не уловят эту тонкость.

Опасения особенно сильны у школ, издательств и работодателей, где метка может быть воспринята как вердикт об авторстве. Одна из критических оценок назвала политику подходом «выжечь всё с орбиты»: системой на уровне модели, которая может штамповать редакторскую работу, от которой правила ЕС как раз и должны были сделать исключение.

Пользователи разделились по более практичной линии. Некоторые комментаторы на Reddit назвали водяной знак «цифровой татуировкой» для студентов, авторов и работников, использующих Claude для умеренной помощи; другие ответили, что он не претендует на авторство, а лишь идентифицирует сгенерированный ИИ контент там, где риски требуют более тщательной проверки.

Anthropic планирует API для обнаружения, но до тех пор, пока внешние стороны не смогут его протестировать, центральное обещание водяного знака остаётся ограниченным: он может упростить выявление присутствия Claude, оставляя более сложный вопрос об авторстве человека нерешённым.

Освещение истории