EBKernel представляет Cog-WM 1.0: когнитивная модель мира, вдохновленная работой мозга

ии робототехника машинное обучение навигация манипуляция pandaily.com

Шанхайский стартап EBKernel запустил Cog-WM 1.0 на Инновационном форуме в Пуцзяне — мировую модель в скрытом пространстве в стиле JEPA, которая повышает успешность ObjectNav без карт с 78,5% до 86,89% по сравнению с BSC-Nav и превосходит pi0.5 в манипуляционных бенчмарках до 16%.

Шанхайский стартап EBKernel представил Cog-WM 1.0 на сессии, посвященной вдохновленному работой мозга воплощенному интеллекту, в рамках Инновационного форума в Пуцзяне 2026 года. Разработка позиционируется как когнитивная мировая модель, построенная на предсказании в скрытом пространстве, а не на повторении пикселей. Компания заявляет, что стек заимствует организационные идеи из человеческих когнитивных карт — избирательное обновление памяти, кодирование с учетом цели и прогнозирование на разных временных горизонтах — и сочетает их с целью совместного предсказания в стиле JEPA, чтобы роботы могли планировать на основе абстрактных пространственных признаков и признаков состояния, а не реконструировать необработанные кадры.

В области навигации Cog-WM Nav 1.0 оценивается без предварительно построенной карты. На подмножестве HM3D-ObjectNav EBKernel сообщает о повышении показателя успешности с 78,50% до 86,89% по сравнению с базовым уровнем BSC-Nav, опубликованным в Nature Communications, что составляет абсолютный прирост в 8,39 пункта (около 10,7% относительно), при этом SPL увеличился с 47,70 до 48,35. Навигационный модуль поддерживает явную пространственную память и предсказывает подцели исследования в скрытом пространстве, затем сопоставляет семантику цели со стоимостью пути — это полезно, когда цель находится вне текущего поля зрения, и роботу необходимо решить, куда смотреть дальше.

Манипуляционный модуль, Cog-WM Manip 1.0, обучает предсказание состояния на разных временных масштабах и опыт, модулированный ценностью, чтобы эффекты действий на коротком горизонте и прогресс выполнения более длительных задач оставались связанными. В рамках унифицированного протокола воспроизведения EBKernel утверждает, что модель превосходит массово предварительно обученные базовые модели в стиле pi0.5 до 16% по трем основным манипуляционным наборам, включая более сложные настройки RoboTwin 2.0. Абляции на LIBERO-Plus представлены как аддитивные: только политика около 80%, локальное предсказание 81,6%, предсказание на разных горизонтах 82,0% и полный стек 84,6%.

Заявки на внедрение уже охватывают колесных гуманоидов и четвероногих роботов для навигации без карт, планирования пути, поиска пространственно-временной памяти, пространственных вопросов и ответов, а также поиска объектов. Манипуляции проверены на колесных гуманоидных телах, а навигация четвероногих роботов отмечена на объектах заказчиков для инспекции или патрулирования. Основанная в середине 2025 года, EBKernel позиционирует обучение в течение всей жизни с низким объемом данных и высокой обобщающей способностью как основную идею продукта. Независимые показатели долговечности на открытом воздухе и дальности действия на длинных горизонтах остаются скудными за пределами корпоративных бенчмарков, поэтому лабораториям следует рассматривать опубликованные показатели SR и манипуляционные дельты как основной набор для сравнения до тех пор, пока не появятся сторонние рабочие нагрузки.

Всегда имейте в виду, что редакции могут придерживаться предвзятых взглядов в освещении новостей.

Похожие новости: