Как AI-агенты учатся сжимать контекст: эволюция подхода
Простой подход — отправлять в следующий вызов весь накопленный лог целиком — перестаёт работать по мере роста истории. Контекстное окно современных моделей может быть огромным, но качество ответа сильно зависит от того, насколько структурированы данные. К тому же полная история разговора и реальный контекст, который модель видит на очередном ходе, — не одно и то же. Именно эта проблема сейчас в фокусе context engineering: что сжать, что вынести наружу, а что подтянуть инструментами только в момент необходимости.
Новый материал разбирает эволюцию подходов к работе с длинной историей. Примеры построены на открытом фреймворке LangChain, который достаточно популярен и активно развивается. На нём легко увидеть реализацию, которая в коммерческих продуктах обычно скрыта. Остальные фреймворки либо делают похожие вещи, либо сами опираются на LangChain как на базу, поэтому разбор этого стека даёт хорошее представление о том, куда движется индустрия.
Источник: habr.com
Поделиться