Разработчики уже обходят невидимые водяные знаки Claude
новости
20.08.2026

Разработчики уже обходят невидимые водяные знаки Claude

Разработчики уже обходят невидимые водяные знаки Claude

Anthropic объявила на прошлой неделе, что встроит невидимые водяные знаки в контент, сгенерированный моделью Claude, чтобы соответствовать новым требованиям Евросоюза. Уже через несколько часов программисты начали публиковать способы обхода этой маркировки.

Первым стал разработчик Гийом Мейер: он выложил код, удаляющий водяные знаки из текстов Claude. Репозиторий мгновенно разлетелся по GitHub, набрал более двадцати тысяч закладок в X и привлек свыше ста контрибьюторов. Сам Мейер пояснил, что одни программисты выступают против обязательной маркировки всего ИИ-контента, другие просто любят решать сложные технические задачи. К нему уже обращаются фрилансеры и авторы контента за помощью в использовании кода.

Новые правила ЕС, вступившие в силу в этом месяце, требуют от провайдеров моделей вроде Anthropic и OpenAI помечать синтетический аудио-, видеоконтент, изображения и текст так, чтобы машина могла распознать их как созданные ИИ. За нарушение грозит штраф до трех процентов годового оборота. Продажа инструментов обхода запрещена, однако на независимые разработки ограничения не распространяются.

Сам Мейер говорит, что не против прозрачности и атрибуции, но считает водяные знаки плохим решением из-за риска ложных срабатываний и неспособности отличить легкое редактирование от полной генерации. Он опасается, что работодатели будут несправедливо отклонять кандидатов, а исследователей ложно обвинят в использовании ИИ.

Технология SynthID, которую использует Anthropic, была разработана Google. Она оставляет в тексте незаметный для человека узор, определяемый машиной. Метод Мейера заключается в многократном переписывании с помощью другой LLM без водяных знаков: синонимы, перестановка предложений. Другие разработчики предлагают более радикальные способы, например перевод через арабский язык.

Anthropic настаивает, что водяные знаки не ухудшают качество ответов, и обещает выпустить API для их обнаружения. Но пока детектор не опубликован, разработчики не могут проверить, работают ли их обходные пути. Впрочем, это их не останавливает.

Источник: www.wired.com