глоссарий

Диффузия

Диффузия

Диффузия в искусственном интеллекте — это метод генеративного моделирования, при котором алгоритм учится создавать новые данные (например, изображения или звук) из случайного шума. Название заимствовано из физики: как чернила постепенно распространяются в воде, так и здесь информация растворяется в хаосе — а затем собирается обратно.

Термин стал одним из ключевых в современном ИИ, потому что именно на диффузии построены мощнейшие генераторы изображений. Они умеют рисовать по текстовому описанию, редактировать фото и даже создавать видео. Без диффузии не было бы того визуального бума, который мы наблюдаем сегодня вокруг нейросетей.

Как это работает на интуитивном уровне? Представьте чёткую фотографию. Сначала алгоритм постепенно добавляет к ней случайный шум, шаг за шагом, пока картинка не превращается в чистую «зернистую помеху». Это прямой процесс. Затем модель тренируют выполнять обратную операцию: по всё более шумному изображению восстанавливать предыдущее, менее зашумлённое. После обучения на огромном количестве примеров она учится «вытаскивать» из полного хаоса осмысленную картинку, начиная с нуля и постепенно уточняя детали.

Прикладной пример — генерация уникальных иллюстраций по текстовому запросу. Вы пишете «кот в скафандре на Марсе», а диффузионная модель, проходит через сотни шагов, превращает случайный шум в изображение, которое соответствует запросу. Пользователь видит лишь результат, но за ним стоит многократное удаление шума и добавление осмысленных деталей.

Диффузия изменила представление о том, как машины могут творить. Она не запоминает готовые картинки, а строит вероятностный процесс их создания. Это делает её невероятно гибкой и мощной техникой, которая продолжает развиваться в области генеративного ИИ, приближая нас к инструментам, способным визуализировать любую идею.