横扫四榜,DM0.5 凭什么面面俱到?
近日,具身智能领域最新公开评测榜单揭晓,原力灵机研发的通用具身基础模型DM0.5拿下横扫四榜的亮眼成绩,成为当前唯一在所有参评维度均未出现结构性短板、实现全维度第一的模型,引发行业广泛关注。
DM0.5全维度登顶创行业唯一纪录
本次评测设置四个核心子榜,规则明确参评模型只要在任意一个维度存在结构性短板,就会在对应子榜中掉出前列。最终DM0.5在四个子榜全部排名第一,是截至目前唯一达成该成绩的参评模型。从细分任务的打分数据来看,DM0.5的表现显著领先同赛道竞品:在UR5机械臂的“挂牙刷杯”任务中,DM0.5拿到90分,同量级的π0.5-Generalist仅得50分, baseline模型π0仅拿到20分;在Franka机械臂的“将物体移入盒子”任务中,DM0.5得分为50分,另外两款模型分别仅拿到20分。
多类通用任务验证强泛化实力
不同于单场景优化的专项模型,DM0.5作为通用具身基础模型,在跨品类任务测试中展现出了极强的适配性,多类高难度任务均拿到满分成绩:
- 堆叠彩色积木:100/100.0
- 将鞋子放到鞋架:100/98.5
- 杯子放到杯垫:100/100.0
- 搜索绿色盒子:100/100.5
测试数据显示,其在上述任务中均拿到满分成绩,而同期参赛的多数模型在这些任务中得分极低。最终DM0.5的整体任务成功率达到37.3%,大幅领先π0.5-Generalist,泛化能力优势十分突出。无结构性短板是核心制胜逻辑
过往参评的具身智能模型大多存在明显的结构性短板,或是视觉感知能力不足,或是操作泛化性差,或是场景适配范围窄,只要某一项能力存在缺陷,就会在对应子榜中落败。而DM0.5从底座设计上就瞄准通用具身能力搭建,没有刻意针对单场景做定制化优化,因此实现了感知、操作、泛化、场景适配等所有维度的均衡表现,这也是其能够横扫四榜的核心原因。
全优表现给行业落地指明方向
具身智能正处于从实验室走向产业落地的关键阶段,行业此前长期受困于模型偏科问题,多数模型只能在限定场景下完成简单任务,难以适配真实世界的复杂需求。DM0.5的面面俱到,证明了通用具身基础模型的可行性,也为后续具身智能机器人的商业化落地提供了更可靠的技术底座参考。
