产品派
返回

DM0.5登顶四项具身智能评测并验证多场景能力

AI雷锋网2026/9/15 10:22:00
AI 导读

原力灵机通用具身基础模型DM0.5在RoboColiseum的指令跟随、空间理解、扰动适应、通用操作四个子榜中全部排名第一,成为目前唯一实现“四榜第一”的模型。该平台由智元机器人联合高校、科研机构、开源社区和机器人企业建设,旨在从多个能力层面检验具身模型。

RoboColiseum针对行业常见的仿真与真机脱节、榜单容易被刷穿、单项能力不能代表真实任务能力等问题,校准物体质量、重心、摩擦力、转动惯量以及机器人相机、刚度和控制响应等参数,仿真与真机表现一致性达到89.5%,单任务成功率差异低于10%。平台包含78个任务和超过3000个泛化案例,并隔离训练集与评测集。

DM0.5四项成绩分别为0.8444、0.6146、0.7344和0.6370。其指令跟随能力来自覆盖规划与动作生成的11项具身思维链任务;空间理解预训练使用10万小时第一视角视频,并支持毫米级三维标注。相关三维表征研究《GeoVLA》还入选IROS 2026认知机器人最佳论文奖提名。

在扰动适应方面,DM0.5通过Vision TensorRT、FlexAttention、FP8、Triton和CUDA Graph等优化,将核心延迟从534毫秒降至57.49毫秒,提速9.29倍;2000个LIBERO测试episode成功率仅由98.45%降至98.40%,并具备原生60秒记忆,可在中断后续接任务。物流分拣准确率超过99%、平均3秒完成一件,亚毫米积木拼装每12秒一次,配合58自由度灵巧手还能完成切削黄瓜等任务。

DM0.5参加RoboColiseum时未针对具体榜单专项优化,仅通过常规监督微调适配机器人构型和任务,因此成绩更接近底座模型通用能力的体现。其在RoboDojo记忆维度得分47.74、成功率47.44%,显著高于第二名的13.37分和12.11%。

跨基准结果也提供了佐证:LIBERO综合成功率99.0%,RoboTwin 2.0简单和复杂场景分别为93.6%和93.3%,VLA-Arena三档难度为89.0%、53.6%和44.1%;导航测试R2R、RxR分别达到59.7%和65.5%。在覆盖ARX5、UR5、ALOHA、Dexmal-Mirror四种机型和30项任务的RoboChallenge Table30 V2真机测试中,整体成功率43.0%、综合得分54.42并列第一。

此外,Physical Intelligence在MEM具身记忆论文及π0.7产品相关工作中两次引用原力灵机的MemoryVLA。该方案受工作记忆和海马体机制启发,构建感知—认知记忆库与双流潜变量记忆。当前DM0.5已通过多项工程优化进入实时控制窗口,API响应p50为67.75毫秒、p90为70.01毫秒,并推进模型权重、训练框架和多类评测及真机方案开源。

具身智能机器人基础模型VLA

本文基于公开渠道信息整理,内容可能存在不准确或遗漏之处,不代表本站立场,如内容涉及侵权或错误,请联系我们处理。

阅读原文