Бывший глава лаборатории Huawei Ван Юньхэ выпустил модель NeoHorse
NeoHorse существует в двух размерах — 4B и 9B. Партнёры помогали с инфраструктурой и алгоритмами, но главная особенность в другом. Стартап несколько лет развивает систему маршрутизации Routing Harness, которая для каждого шага агента выбирает подходящую модель. В процессе работы накопились записи реальных траекторий: что делали разные модели, на каких шагах сбоили и как другие исправляли их ошибки. Именно эти траектории, а не только пары «вопрос-ответ», стали материалом для пост-обучения NeoHorse.
Благодаря этому 4B-версия после agentic post-training по ряду тестов достигла уровня базовой 9B-модели и стала лучшей в своём классе. Идея в том, чтобы компактная модель закрывала большинство рутинных действий, а большие подключались только в сложных случаях.
В компании называют NeoHorse первым шагом к рекурсивному самоулучшению (RSI): данные из Routing Harness обучают модель, обновлённая модель возвращается в систему и генерирует ещё более ценные данные. Пока это лишь один цикл, и его устойчивость при повторении предстоит доказать.
Параллельно Ван Юньхэ продолжает развивать «многоуровневый» бизнес: открытые инструменты маршрутизации, API для доступа к чужим моделям и корпоративные решения. Вопрос в том, выдержит ли такая модель конкуренцию с производителями больших ИИ, которые встраивают агентские функции прямо в свои продукты.
Источник: www.qbitai.com
Поделиться