Загадочная модель ИИ дала роботам Unitree и Zhiyuan общий мозг: 10 минут без монтажа
Съёмка ведётся без единой склейки: без монтажа, без удалённого управления и без заранее прописанных команд. Роботы свободно перемещаются по тесной квартире, протирают окно, высовывая руку с салфеткой наружу, убирают вещи по местам и спокойно переживают внезапные прерывания. В какой-то момент робот не может дотянуться до полки: он сам притаскивает ящик, пытается на него встать, не сгибается — и просто пинает ящик ногой к нужному месту. В другом эпизоде один робот снимает шарф с плеча другого, аккуратно огибая его голову и учитывая физику и пространство.
Утверждается, что модель обучалась всего на нескольких десятках часов видео. Если так, это ставит под сомнение привычные законы масштабирования ИИ. По словам осведомлённого источника, архитектура не похожа ни на VLA, ни на классические world model: вместо «угадывания следующего действия» здесь физически согласованное моделирование динамики, общее пространство действий для разных роботов и устойчивый к сбоям длинный горизонт планирования.
Имя создателей пока неизвестно. Но именно такие неотполированные ролики, а не постановочные демо, могут оказаться настоящим «моментом ChatGPT» в робототехнике.
Источник: www.qbitai.com
Поделиться