глоссарий

Semantic segmentation

Semantic segmentation

Семантическая сегментация — задача компьютерного зрения, где каждый пиксель изображения относится к категории объекта. В отличие от классификации («что на фото?») и детекции («где объект?»), она строит точную карту границ: человек, дорога, небо, машина. Это нужно для систем, требующих детального понимания пространства. Например, беспилотник определяет край дороги, пешеходов и луж; в медицине сегментация выделяет опухоль на МРТ с точностью до миллиметра. Без неё роботы и диагностика остаются «слепыми».

Интуитивно процесс похож на обводку объектов на фото: нейросеть обучается на тысячах размеченных примеров, сначала выделяя линии и углы, затем собирая их в детали (колёса, окна), и наконец присваивает метку каждому пикселю с учётом формы, границ и окружения. Контекст помогает не путать траву в тени автомобиля с дорогой.

Классический пример — автопилот: камера передаёт видео, сеть в реальном времени раскрашивает кадры (тротуар серым, дорогу синим, людей жёлтым). Точность сегментации критична: ошибка в пару пикселей может стоить жизни. Так «сырое» изображение превращается в структурированное понимание сцены — ключевой шаг к ИИ, взаимодействующему с физическим миром, и основе современных беспилотников, умных камер и медицинских систем.