Split learning
Зачем это нужно? Данные о людях, документах или производстве часто чувствительны, поэтому нельзя просто отправить их на центральный сервер. Клиники, банки и промышленные компании обязаны защищать приватность. Split learning даёт золотую середину: выгода от большой обучающей выборки без раскрытия её содержимого. Плюс снижается нагрузка на сеть — передавать небольшие векторы дешевле, чем терабайты информации.
Прикладной пример: несколько больниц хотят обучить модель диагностики рака по снимкам. Каждая хранит свои изображения локально. Первые слои нейросети обрабатывают снимок в каждой больнице, затем промежуточный результат уходит на общий сервер, где модель достраивает диагноз. Сервер не видит сами изображения — только абстрактные признаки. В итоге модель обучена на огромном массиве данных и ставит диагноз точнее, чем любая отдельная больница, а конфиденциальность пациентов сохранена.
Таким образом, split learning — это способ объединять знания разных организаций, защищая данные. По мере роста требований к приватности он становится важным инструментом для ИИ, который умеет сотрудничать, но не подглядывать.
Поделиться