глоссарий

Repetition penalty

Repetition penalty

Repetition penalty (штраф за повторения) — это параметр генерации текста в больших языковых моделях, который снижает вероятность повторного выбора уже использованных слов или токенов. Если задать его равным нулю, модель может начать бесконечно зацикливаться на одних и тех же фразах, словно заезженная пластинка. Он важен, потому что без него нейросети теряют связность, раздражают пользователя и впустую тратят вычислительные ресурсы.

Как это работает на интуитивном уровне? Представьте, что во время разговора у каждого слова есть свой «вес голоса». Когда слово уже прозвучало, его голос становится тише, а если оно повторяется снова — ещё тише. Именно этот эффект и создаёт penalty: при каждом следующем появлении токена вероятность его выбора умножается на коэффициент меньше единицы. Чем выше значение штрафа, тем сильнее модель избегает повторов, зато может начать чрезмерно «изобретать» новые формулировки, что тоже вредно.

Прикладной пример: при генерации длинного ответа в технической поддержке без штрафа модель напишет: «Для решения проблемы нужно перезагрузить устройство. Для решения проблемы нужно также проверить соединение. Для решения проблемы...» — и так до бесконечности. С правильно подобранным repetition penalty она выдаст стройный текст, где повторы будут уместными, а не навязчивыми.

Вывод: repetition penalty — это простой, но мощный рычаг управления качеством генерации. Он позволяет балансировать между связностью и разнообразием текста, делая диалоги с искусственным интеллектом естественнее. Главное — не перестараться, ведь слишком жёсткий штраф делает текст рваным и неестественным.