Как работают текстовые ИИ-вотермарки и как их обходить
новости
12.08.2026

Как работают текстовые ИИ-вотермарки и как их обходить

Как работают текстовые ИИ-вотермарки и как их обходить

Новые законы Евросоюза обязывают разработчиков больших языковых моделей помечать тексты, созданные искусственным интеллектом. Компании, в том числе Anthropic с её чат-ботом Claude, уже обновили справочную документацию, однако подробности работы своих маркеров раскрывать не спешат. Не публикуют они и инструменты для нанесения и проверки таких вотермарок.

Это вызывает беспокойство у пользователей: текст могут ошибочно признать сгенерированным ИИ, например, если человек лишь частично отредактировал его с помощью нейросети. В материале разбирается, как именно работают текстовые вотермарки и какие способы обхода существуют. Обычно такие метки встраиваются в статистику выбора токенов: модель незаметно изменяет распределение слов, создавая уникальный паттерн, который можно обнаружить алгоритмически. Однако эти метки неустойчивы к перефразированию, переводу или даже незначительной ручной правке. Поэтому эффективными методами борьбы считаются синонимические замены, изменение порядка слов, вставка намеренных ошибок или использование альтернативных моделей для генерации. Пока технология маркировки только развивается, и её надёжность остаётся под вопросом.

Источник: habr.com