Тайна модели Ox Alpha раскрыта: это GLM-5.3 Flash от Zhipu на отечественных чипах
Слухи вокруг «быка» появились после того, как модель в течение нескольких дней держалась на вершине OpenRouter и побила рекорд по суточному расходу токенов. Затем она прервала 56-дневную гегемонию DeepSeek в рейтинге OpenCode. Пользователи успели провести собственные тесты: например, создать с её помощью интерактивный 3D-сайт двигателя SpaceX Raptor или заставить модель самостоятельно справиться со сложными задачами. После того как Zhipu раскрыла авторство, стали понятны и технические причины ажиотажа.
GLM-5.3 Flash имеет 320 миллиардов параметров, но активирует при работе лишь 18 миллиардов и при этом превосходит более крупную GLM-5.2. Модель использует смешанную архитектуру с линейным и разреженным вниманием и специальный индексный пул, что снижает вычислительные затраты на внимание примерно втрое и вчетверо уменьшает объём кэша. Ей доступен контекст до миллиона токенов.
В тестах Zhipu и независимых бенчмарках модель показывает уровень 57 баллов в рейтинге AA — столько же, сколько набирает Claude Opus 4.8, при том что стоимость её использования в десятки раз ниже. Визуальные возможности не ограничены статичными картинками: GLM-5.3 Flash умеет распознавать говорящих в видео, генерировать точные субтитры, а также превращать скриншот дизайна в работающее приложение. Разработчики даже заставили её в течение двенадцати часов самостоятельно строить 3D-сцену в Blender.
При этом модель не только быстро работает, но и красиво стоит: благодаря эффективной архитектуре она выдерживает мировую нагрузку на китайских ускорителях, а её исходный код открыт для всех. Так что Ox Alpha — это не просто очередная «умная» нейросеть, а демонстрация того, что современная китайская AI-экосистема готова предлагать передовые модели по цене массового продукта.
Источник: www.qbitai.com
Поделиться