Anthropic, OpenAI и Google будут помечать создаваемые тексты невидимыми ИИ-вотермарками
Поводом для обсуждений стало обновление справочной документации Anthropic, где прямо сказано, что ответы Claude будут помечаться. Это известие вызвало волну вопросов: как именно работает технология, какие риски она несёт и чего ждать дальше.
Как выяснилось, водяные знаки изменяют механику выбора слов внутри нейросети, оставляя статистически значимый паттерн. На качестве текста это не сказывается, зато специальные алгоритмы могут распознать цифровой почерк с высокой точностью. Компании обещают, что метки появятся как в веб-интерфейсах, так и в API.
Эксперты связывают эту инициативу с усиливающимся давлением регуляторов и борцов с дезинформацией. Фейковые новости, поддельные отзывы и фишинг уже давно создаются с помощью ИИ, и маркировка должна усложнить анонимное распространение такого контента. Однако есть и скептики: они напоминают, что водяные знаки можно попытаться удалить перефразированием, а вероятность ошибок при определении авторства никуда не делась.
Тем не менее, согласованные действия трёх главных игроков рынка создают важный прецедент. Ожидается, что к добровольной маркировке присоединятся и другие разработчики — это позволит выработать общий стандарт, без которого невозможно эффективное регулирование ИИ. Пока же юристы обсуждают, стоит ли вводить ответственность за сокрытие таких меток и как защитить права пользователей, которые могут быть не в курсе, что их переписку анализируют на предмет синтетичности.
Источник: habr.com
Поделиться