什么是 RoboDojo 评测?
RoboDojo 是一个由香港大学多媒体实验室联合 UC 伯克利、清华等近 20 所机构推出的机器人模型权威测评,设 60 道题,覆盖泛化、记忆、精细操作、长程执行和开放语义理解,分仿真和真机双轨进行。

本文介绍具身智能评测基准RoboDojo及其结果,指出当前具身模型平均成功率远低于人类,并重点分析原力灵机开源模型DM0.5的登顶表现:凭借原生60秒记忆、具身思维链、57毫秒低延迟等能力,在记忆维度大幅领先;其全面开源策略或推动行业从Demo表演走向可信评测。
RoboDojo 是一个由香港大学多媒体实验室联合 UC 伯克利、清华等近 20 所机构推出的机器人模型权威测评,设 60 道题,覆盖泛化、记忆、精细操作、长程执行和开放语义理解,分仿真和真机双轨进行。
原力灵机提出的通用具身基础模型 DM0.5 以综合得分 24.90、平均成功率 19.34% 获得双项第一;其中 Memory 维度得分 47.74,成功率 47.44%,远超第二名。
因为真实操作大多是长程任务,而主流 VLA 模型往往只看当前帧,容易'走一步忘一步'。DM0.5 通过原生 60 秒记忆和预训练阶段的能力构建,能够在记忆维度大幅领先,并支撑长时间稳定作业。
Anew Labs已完成 2.9 亿美元融资,红杉中国、高瓴、IDG、五源、高榕等参与
Java新闻汇总:Simple JSON API、GlassFish、Jakarta EE、JNoSQL和Open Liberty、LangChain4j企业案例分享:玉盘量智-离子阱量子计算芯片化集成工程实践 | 36氪 2026产业未来大会
CLARITY的失败 跟加密行业好坏没啥关系
奇安信斩获国家信息安全漏洞库CNNVD两项重磅荣誉
豆包工作还想反超WorkBuddy?
缓存不该困在一台服务器里
二次元“赛博分身”撬动日本市场:玩家“沉默”的AI陪伴产品,凭什么次留60%?
就业率砍半,年轻人靠什么翻盘?AI时代,这三点越早做越好
让 AI 补货,但不让它算库存——LangGraph 在生鲜补货的落地实践华为GTS让Agent学会「看着网络排障」,双防火墙难题几乎全拿下AWS 称无法恢复中东部分可用区资源和数据的访问圆桌:探路·产业分工的新图谱,看到新未来——国家力量如何转化为产业价值 | 36氪 2026产业未来大会
OpenAI 总裁最新采访:现在所有人对 AI 的预测,大概率都是错的
AI不断进步 不得不把才华埋葬在昨天Windows 11 的 9 月例行安全更新再次引发了大量故障
一年28倍妖王:谁在爆炒?
Opus 5.2深夜上线 RSI真来了?无问芯穹联合清华、上交正式开源具身端侧推理引擎APXInf,Pi 0.5性能SOTA
别闹,几粒盐就能立起高脚杯?你是不是用胶水了?
一边喊停一边敲钟:硅谷AI巨头到底在怕什么
129亿美元卖身英伟达之后,是时候重新理解Hugging Face了美国军方首次证实在太空部署了武器36氪首发 | 国内头部硅电容IDM企业融资亿元,切入AI芯片与高端光模块
谁在给我们制造 AI 焦虑
个贷不良四年涨 23 倍:这门从“救大行”长出来的生意,底层逻辑是什么?
长期利率为何不愿下跌?前OpenAI后训练VP回应陶哲轩:说AI毁了数学,可能还是太小瞧AI了
云连锁到轻连锁,品牌业务逻辑的改变