Сунь Пэн из ByteDance перешёл в Xingchen Intelligence для работы над Physical AI
В последние годы базовые модели роботов отвечали на вопрос «умеет ли робот выполнять действие». Теперь индустрию интересует, может ли он делать это стабильно в реальных условиях. Именно поэтому обучение с подкреплением снова оказалось в центре: оно позволяет роботу корректировать поведение на основе обратной связи.
Сунь Пэн окончил Университет Цинхуа, затем работал в Tencent над RL-роботами и агентами для StarCraft. В ByteDance он создал RL-инфраструктуру ByteRL, а позже занимался постобучением больших языковых моделей, включая методы ReFT и DeltaProver.
В Xingchen Intelligence он займётся роботизированным RL и постобучением в связке с моделью Lumo, агентским решением Philia и роботом с тросовым приводом — так компания замыкает контур Physical AI.
Сунь Пэн говорит, что прошёл путь от RL в робототехнике и играх до постобучения больших моделей и теперь хочет вернуть эти методы в физический мир.
Источник: www.qbitai.com
Поделиться