Anthropic добавила водяные знаки в тексты ИИ, и тут же появились инструменты для их удаления
Обеспокоенность быстро переросла в активные действия. По данным Google Trends, интерес к запросу «AI watermark remover» (инструмент для удаления ИИ-водяных знаков) за месяц вырос на 60 процентов. На этом фоне появились первые проекты, предлагающие решение. Парижский предприниматель Гийом Мейер, основатель AI-стартапа Memo, создал открытый инструмент Watermarks Remover всего за пять часов. Программа удаляет скрытые символы и метаданные, а затем переписывает текст, сохраняя его смысл, что должно разрушить статистические закономерности, на которых основан водяной знак. Проект уже собрал более четырнадцати тысяч звезд на GitHub, хотя сам автор признает, что стопроцентную гарантию удаления метки инструмент не дает. Мейер подчеркивает, что поддерживает идею указания авторства, но считает водяные знаки неправильным подходом. По его мнению, они делают авторство черно-белым понятием, тогда как в реальности грань между полностью сгенерированным и лишь отредактированным человеком текстом размыта. Anthropic в ответ пояснила, что водяные знаки не предназначены для определения авторства.
На этом инициативы не закончились. Преподаватель и предприниматель Сабрина Рамонова выпустила бесплатный браузерный инструмент, который обещает «очистить скрытые метки ИИ» из текстов, PDF-документов, веб-страниц и изображений. Разработчик из Токио Анш Анеджа создал утилиту для удаления водяных знаков Claude в тот же день, когда Anthropic объявила о новой функции, а позже опубликовал локальную открытую версию под названием MarkScrub. Анеджа утверждает, что за сутки число пользователей его инструмента выросло с нуля до 8,5 тысячи человек, хотя независимого подтверждения этой цифры нет.
Все эти проекты находятся на ранней стадии, и их эффективность пока не доказана. Исследователь из Швейцарской высшей технической школы Цюриха Тибо Глогуэн напоминает, что водяные знаки имеют давнюю проблему: их можно удалить. Даже простое переписывание текста своими словами разрушает исходную статистическую структуру. Юридический статус таких инструментов тоже туманен. В Евросоюзе, где Anthropic стремится соблюдать требования закона об искусственном интеллекте, маркировка ИИ-контента обязательна, но запрет на удаление этих меток отсутствует. В Еврокомиссии отмечают, что требования касаются прежде всего самих провайдеров ИИ-сервисов, а не третьих лиц. Однако если инструмент удаления сам использует генеративные модели для переписывания текста, его создатели могут быть обязаны маркировать и собственный результат.
Юристы сходятся во мнении, что европейское законодательство, как и условия использования Anthropic, пока не запрещают разработку и распространение подобных утилит. Проблемы могут возникнуть лишь при использовании их для выдачи машинного контента за человеческий. Тем временем Anthropic готовит отдельный API для детектирования водяных знаков и планирует распространить их на более старые модели. По словам эксперта Конрада Коллинга из Маастрихтского университета, у всех таких технологий есть общая уязвимость: как только детектор становится публичным, тут же находятся способы обойти его и создать средство для удаления меток.
Источник: www.ithome.com
Поделиться