什么是 RoboDojo 评测?
RoboDojo 是一个由香港大学多媒体实验室联合 UC 伯克利、清华等近 20 所机构推出的机器人模型权威测评,设 60 道题,覆盖泛化、记忆、精细操作、长程执行和开放语义理解,分仿真和真机双轨进行。

本文介绍具身智能评测基准RoboDojo及其结果,指出当前具身模型平均成功率远低于人类,并重点分析原力灵机开源模型DM0.5的登顶表现:凭借原生60秒记忆、具身思维链、57毫秒低延迟等能力,在记忆维度大幅领先;其全面开源策略或推动行业从Demo表演走向可信评测。
RoboDojo 是一个由香港大学多媒体实验室联合 UC 伯克利、清华等近 20 所机构推出的机器人模型权威测评,设 60 道题,覆盖泛化、记忆、精细操作、长程执行和开放语义理解,分仿真和真机双轨进行。
原力灵机提出的通用具身基础模型 DM0.5 以综合得分 24.90、平均成功率 19.34% 获得双项第一;其中 Memory 维度得分 47.74,成功率 47.44%,远超第二名。
因为真实操作大多是长程任务,而主流 VLA 模型往往只看当前帧,容易'走一步忘一步'。DM0.5 通过原生 60 秒记忆和预训练阶段的能力构建,能够在记忆维度大幅领先,并支撑长时间稳定作业。
产品定义意义上的一级场景:四维模型
AI 写了几十页 PPT,“经营分析”报告仍被批不够深入?
从200亿收购失败到650亿IPO:Figma如何用“协作”颠覆设计帝国
派早报:Steam Frame 开启预购、WPS 多端支持 Markdown 等
渣打给ARB十美元目标价靠什么?
DeepSeek-V4.1-Flash 的最佳 Harness 搭档,我觉得可能是 Claude CodeFAST 发现极短周期、最轻双中子星系统
HYROX比赛腹泻这事,运动员拼归拼,但主办方不能装看不见
金色Web3.0日报 | 黄仁勋批驳「AI末日论」
碧桂园服务与支付宝全面深化合作,共筑“智慧物业”数字化新标杆
19.98 万元起,吉利银河战舰 700 开启预售,最高 1129 匹马力,还有三电机四驱
AI攻克世纪数学难题,顶尖数学家抱团抵制,而他们担心的并不是丢了工作
展翼之后,三折叠再次进化:HUAWEI Mate XT 2 非凡大师深度体验评测
读完斯坦福116页AI实施手册,我最大的感受是:别再盯着模型了
当年救了臭氧层的功臣,现在变成了永久性污染物
Cloudflare将每天90亿次请求的JavaScript CDN迁移到其开发者平台
英伟达开源 IMO 金牌配方:不仅是「人海战术」,1.5TB 显存做实 AI「 推恩令」?
超级智能体“迪迪虾”上车,比亚迪携手阿里云推进智能座舱升级
从担心AI失控 到AI造福人类:比尔盖茨怎么想
横扫四榜,DM0.5 凭什么面面俱到?Mozilla 报告称中国开放权重模型与美国前沿模型仅相差 4.4 个月Mistral 与 Mozilla 合作推出 Firefox Smart Window产品观察丨xTool做了一台3000元起步的激光雕刻机,难的不只是价格Firefox 156 释出
QQ 飞车 Agentic 研发转型过程中的Loop Engineering
AI for everyone in every language
美国加密新规又黄了
How NVIDIA Groq 3 LPX Deterministic Execution Drives Power-Efficient High-Interactivity Inference on NVIDIA Vera Rubin
Opus 5.2深夜上线 RSI真来了?
「沃什时代」首次加息要来了?华尔街算好了三种剧本