Qwen Office запустил Qwen3.8-Flash: генерация вдвое быстрее,
новости
27.08.2026

Qwen Office запустил Qwen3.8-Flash: генерация вдвое быстрее, токенов на 75% меньше

Qwen Office запустил Qwen3.8-Flash: генерация вдвое быстрее, токенов на 75% меньше

Вечером 26 августа офисный сервис Qwen Office (千问办公) первым подключил модель Qwen3.8-Flash и представил стандартный режим. Теперь пользователи могут работать быстрее, тратя меньше баллов: пропускная способность при обработке токенов выросла. В будущем останется два режима — стандартный и продвинутый. Стандартный справится с 95% повседневных задач, продвинутый понадобится лишь для 5% сложных.

Улучшения связаны с апгрейдом модели и совместной оптимизацией агента и модели. Qwen3.8-Flash на новой архитектуре с сотнями миллиардов параметров превосходит Claude Opus 4.6. Специальная офисная версия модели дообучалась под многошаговое планирование, выбор инструментов и сжатие контекста, что позволило нарастить пропускную способность. В реальных офисных тестах скорость генерации в стандартном режиме выросла вдвое, а средний расход токенов упал на 75%.

Раньше в ИИ приходилось выбирать между мощью и стоимостью. Глубокая связка агента с моделью ломает этот «невозможный треугольник» производительности, цены и скорости. С ростом интеллектуальной плотности моделей и взаимной оптимизацией с Qwen Office агенты избавятся от «токеновой тревожности» и вступят в эпоху изобилия, когда больше значит лучше.

Источник: www.qbitai.com