Компания Unitree Robotics начала выпуск частичных весов модели и наборов данных для UnifoLM-WLA-1.0 — своей базовой модели для гуманоидных роботов объемом около 6 миллиардов параметров, охватывающей языковые команды и действия в мировом масштабе. Ранее компания уже публиковала архитектуру и матрицу оценки для 64 задач. Согласно китайским технологическим новостям от 20 сентября, части стека теперь доступны для загрузки со страницы проекта, в то время как код после обучения, веса UnifoLM-WLA-Base, корпуса для телеоперации всего тела и более широкие наборы данных операций остаются в списке для последующих релизов. Этот поэтапный открытый выпуск обновляет предыдущее объявление на странице проекта, где код, модели и наборы данных все еще были помечены как «скоро». Программная часть остается отдельной от недавнего обновления оборудования Unitree G1+.
Одна контрольная точка обучена примерно на 2500 часах данных реальных роботов, полученных из открытых наборов Unitree и общедоступных источников, таких как BitRobot HIW-500. Модель предназначена для выполнения 10 задач, связанных с управлением всем телом, и 54 задач, выполняемых на столешнице, без необходимости запуска отдельной политики для каждой задачи. Примеры бытовых задач, приведенные Unitree, варьируются от складывания полотенец и расстановки тарелок до зарядки аккумуляторов, стирки одежды и уборки диванов — задач, которые требуют синхронизации рук, конечных эффекторов и ног. Единое пространство действий токенизирует позы конечных эффекторов, суставы рук и суставы нижней части тела с помощью остаточной векторной квантизации, чтобы эти потоки оставались синхронизированными по времени. В раскрытых тестах поддерживаются параллельные двухпальцевые захваты и многопальцевые руки.
За экспертом действий MMDiT стоит UnifoLM-ER-1-4B — модель воплощенного рассуждения, построенная на базе Qwen3-VL-4B и более чем 5 миллионов пространственных выборок, охватывающих указание, обнаружение, многокартинное рассуждение и прогнозирование траектории. Unitree сообщает, что модель превосходит открытые модели по семи из шестнадцати тестов мультимодального восприятия, которые она провела, включая Where2Place, EmbSpatial и RoboSpatial, при этом несколько показателей конкурентоспособны с проприетарными системами на тех же таблицах. Эти цифры предоставлены компанией и еще не были воспроизведены сторонними исследователями, и сами по себе не доказывают успешность реальных роботов в незнакомых условиях.
Для интеграторов практический сигнал заключается в поэтапном открытом выпуске: сейчас доступны частичные веса, а полный код и корпуса еще ожидаются. До тех пор, пока не будут выпущены оставшиеся активы, заявления о переносе на роботов других производителей следует рассматривать как дорожную карту, а не как готовый сторонний комплект.
Всегда имейте в виду, что редакции могут придерживаться предвзятых взглядов в освещении новостей.
Автор – Pandaily




