Huawei Ascend адаптировал открытую модель Xiaohongshu dots3-note в день релиза
dots3-note preview — первый представитель семейства dots3. Его особенность — архитектура с 280 млрд параметров, из которых при инференсе активируется лишь 16 млрд. Модель понимает текст, изображения и речь, а также поддерживает сценарии, где эти модальности сочетаются. По заявлению разработчиков, она оптимизирована для рассуждений, работы с агентами и мультимодального восприятия и по многим задачам не уступает более крупным моделям, в том числе зарубежным.
Инженеры Ascend подготовили решение в день выхода модели. Адаптация затронула все этапы обработки: визуальный кодер, извлечение аудиопризнаков и основную LLM-часть объединены в единый конвейер. Благодаря этому модель стабильно обрабатывает изображения с текстом, аудио с текстом и видео. Для повышения производительности использован ряд низкоуровневых оптимизаций. Например, FlashComm позволяет избавиться от лишних операций при коммуникациях между ускорителями, а объединение операций в MoE-слое сокращает число запусков ядер и ускоряет вывод.
Отдельно отмечается поддержка механизма MTP-спекулятивного декодирования, который за один проход генерирует несколько токенов-кандидатов и проверяет их. Это снижает задержку при генерации одного токена (TPOT) и повышает пропускную способность, что критично для высоконагруженных онлайн-сервисов. В Huawei подчеркивают, что модель сохраняет все свои мультимодальные способности и при этом работает стабильно и быстрее.
Источник: www.ithome.com
Поделиться