Qwen Office запустил Qwen3.8-Flash: генерация вдвое быстрее, токенов на 75% меньше
Улучшения связаны с апгрейдом модели и совместной оптимизацией агента и модели. Qwen3.8-Flash на новой архитектуре с сотнями миллиардов параметров превосходит Claude Opus 4.6. Специальная офисная версия модели дообучалась под многошаговое планирование, выбор инструментов и сжатие контекста, что позволило нарастить пропускную способность. В реальных офисных тестах скорость генерации в стандартном режиме выросла вдвое, а средний расход токенов упал на 75%.
Раньше в ИИ приходилось выбирать между мощью и стоимостью. Глубокая связка агента с моделью ломает этот «невозможный треугольник» производительности, цены и скорости. С ростом интеллектуальной плотности моделей и взаимной оптимизацией с Qwen Office агенты избавятся от «токеновой тревожности» и вступят в эпоху изобилия, когда больше значит лучше.
Источник: www.qbitai.com
Поделиться