глоссарий

Adversarial example

Adversarial example

Adversarial example — это специально искажённые входные данные, которые заставляют нейросеть ошибаться, оставаясь незаметными для человека. Например, на фото панды добавляют едва уловимый цифровой шум — глаз видит панду, а алгоритм уверенно говорит «гиббон». Такие искажения и называются состязательными примерами.

Термин важен, потому что вскрывает уязвимость современного ИИ. Нейросети работают отлично в «тепличных» условиях, но их логика radically отличается от человеческой: они опираются на статистику, а не на понимание. Злоумышленник может использовать это в системах с дорогой ценой ошибки: беспилотники, банковский скоринг, медицина, распознавание лиц. Изучение состязательных примеров помогает делать алгоритмы устойчивее.

Представьте нейросеть как наивную собаку, которая узнаёт хозяина по запаху одеколона. Нанесите тот же запах на незнакомца — собака бросится к нему, игнорируя внешность. В пиксельном мире «запах» — это невидимые глазу отклонения яркости или цвета, решающие для машины. Специальный алгоритм подбирает их, чтобы активировать нужные нейроны и переключить ответ на ложный класс.

Классический пример — атака на распознавание дорожных знаков. Наклеив несколько крошечных чёрно-белых квадратиков на «Стоп», исследователи заставили автопилот прочитать «Уступи дорогу». Водитель видит одно, нейросеть — другое, а для атаки хватит обычного принтера. Это реальная угроза для автономного транспорта.

Главный вывод: состязательные примеры — не забавный трюк, а серьёзный вызов для ИИ. Они показывают, что машинный «интеллект» хрупок и предсказуемо обманываем. При внедрении нейросетей в критических сферах необходимо учитывать возможное враждебное вмешательство.