глоссарий

EnCodec

EnCodec

EnCodec — нейросетевой аудиокодек от Meta AI. Он сжимает звук так, чтобы он занимал мало места, но звучал почти как оригинал. В отличие от классических кодеков вроде MP3, EnCodec обучается на больших данных и сам находит закономерности в звуке, поэтому при том же битрейте работает эффективнее.

Это важно, потому что аудио передаётся постоянно: звонки, музыка, подкасты, голосовые сообщения. Обычные кодеки при сильном сжатии дают «цифровой мусор» — шипение и потерю деталей. EnCodec сжимает звук сильнее, сохраняя чистоту, что экономит трафик и память — критично для мобильной связи и стриминга.

Как это работает интуитивно: представьте художника, который рисует не каждый листик, а общую композицию, а второй по этой схеме воссоздаёт картину. EnCodec — два таких «художника». Кодировщик превращает аудио в компактный набор чисел, отбрасывая неважное. Декодировщик по числам реконструирует звук. Обучение идёт так: кодек сжимает и восстанавливает звук, сравнивает с оригиналом и корректирует себя, пока ошибка не станет минимальной. Это как «испорченный телефон», только нейросеть учится на миллионах примеров.

Пример: вы диктуете голосовое сообщение при плохом интернете. EnCodec так сильно сжимает голос, что он уходит даже при медленном соединении, а собеседник слышит вас чётко, без металлического эха. Технологию уже тестируют в музыкальных сервисах для потокового звука.

В итоге EnCodec — шаг к тому, чтобы компьютеры понимали аудио как люди. Он не просто сжимает звук, а «переосмысливает» его, делая звуковые коммуникации чище и доступнее.