Linear probe
Метод даёт недорогой способ заглянуть в «мышление» сети, не переобучая её. Берём вектор признаков из слоя и пытаемся предсказать по нему конкретное свойство. Успех говорит, что знание уже присутствует, провал — что оно либо отсутствует, либо запутано в нелинейных комбинациях. Это ключевой инструмент для диагностики предвзятости и проверки переносимости выученных признаков.
Интуитивно работает так: нейросеть раскладывает объекты в многомерном пространстве, похожие оказываются рядом. Линейный зонд проводит гиперплоскость, разделяющую классы. Если объекты чётко разнесены — он сработает отлично; если перемешаны — линейного разделения не выйдет, значит, информация закодирована неявно.
Прикладной пример: модель ставит диагноз по рентгеновским снимкам лёгких. Подключаем зонд к последнему слою и просим угадать возраст пациента. Если он легко справляется, это тревожный сигнал: сеть невольно выучила демографические признаки, способные искажать выводы для разных групп людей. Так вскрываются скрытые смещения данных ещё до внедрения модели в клинику.
Краткий итог: линейный зонд — дешёвая и прозрачная диагностическая техника, которая отделяет простое знание от сложного. Она не улучшает модель, но помогает понять, что именно выучила сеть, какие признаки легко переносятся в другие задачи и где спрятаны нежелательные зависимости. За эту простоту и информативность метод ценят и в лабораториях, и в индустрии.
Поделиться