История
август 19, 2026
Невидимый водяной знак Claude провоцирует спор о том, кто заслуживает авторство
Anthropic заявляет, что новый водяной знак Claude — это безопасный для приватности инструмент прозрачности, необходимый по правилам ЕС. Критики опасаются, что он размоет границу между текстами, полностью созданными ИИ, и работами, в которых человеку лишь немного помогли — а разработчики уже тестируют способы его обхода.
Попытка Anthropic сделать тексты, написанные ИИ, более прозрачными поставила более острый вопрос: в какой момент полезное редактирование превращается в несмываемую цифровую метку?
2 августа Anthropic начала применять машинно-считываемые водяные знаки к тексту, создаваемому поддерживаемыми новыми моделями Claude по всему миру, ссылаясь на обязательства по прозрачности в рамках регламента ЕС об ИИ. Компания утверждает, что метка не является скрытым символом или устройством отслеживания пользователей; это статистический рисунок в низкозначимых выборах слов, предназначенный лишь для того, чтобы показать вероятность участия Claude. «Водяной знак не содержит идентифицирующей информации и не может быть привязан к конкретному человеку, организации или чату», — заявила Anthropic.1
Техническая позиция лаборатории проста: читатели не должны замечать разницы, тогда как авторизованное средство обнаружения сможет выявить шаблон на достаточно большом объёме текста. Anthropic утверждает, что её система, основанная на подходе SynthID-Text от Google DeepMind, практически не влияет на качество, креативность или удобочитаемость. Она также признаёт ограничения: короткие фрагменты, фактологическая проза, точный код и слегка вычитанные человеком тексты могут содержать слишком слабый сигнал для надёжного обнаружения. «Водяной знак применяется только к словам, которые выбирает Claude», — заявила компания.1
Это различие не сняло волну критики. Оппоненты опасаются, что положительный результат будут трактовать как доказательство полностью ИИ-авторства, тогда как Claude лишь переводил, форматировал или редактировал человеческий текст. В одном анализе утверждалось, что маркировка на уровне модели может клеймить материалы, которые правила ЕС прямо освобождают от раскрытия, превращая проверку грамматики в вводящий в заблуждение сигнал о происхождении текста.2 Сторонники возражают, что такая неоднозначность лучше, чем мир, в котором читатели вовсе не могут понять, отражает ли текст чьё‑то человеческое мышление; дискуссия уже вышла за рамки классов и заявлений о приёме на работу и затронула вопросы авторского права и профессиональной этики.3
Затем последовал предсказуемый стресс-тест. Разработчики быстро выпустили ин струменты, якобы очищающие или переписывающие текст так, чтобы убрать сигнал, в то время как исследователи отметили, что достаточно радикальная переформулировка может свести текстовые водяные знаки на нет. «Способы убрать водяной знак будут всегда», — сказал исследователь ETH Zurich Тибо Глуаген, указывая на полную перепись текста.4 Ответ Anthropic — планируемый API для обнаружения. Куда сложнее будет убедить публику в том, что метка Claude означает лишь участие, а не вердикт о подлинном авторстве.