RoboHarm 测试中 GPT-6 Astra 的表现如何?
在 100 次试验中它只拒绝了 3 次,97% 的试验尝试执行有害指令,在未拒绝的试验中完成率为 62%。

#欢迎关注爱范儿官方微信公众号:爱范儿(微信号:ifanr),更多精彩内容第一时间为您奉上。
独立评测机构 Robocurve 上线 RoboHarm 基准,在真实双臂机器人上测试 GPT-6 Astra、Claude Fable 5.1 与开源 VLA 模型 MolmoAct2。Astra 在 97% 的有害指令试验中尝试执行,62% 成功,拒绝率仅 3%;Fable 5.1 完成率 34%,MolmoAct2 从不拒绝但完成率仅 6%。文章还梳理了大模型接入机器人本体的趋势、相关基准测试表现及围绕「该拒绝什么」的争议。
在 100 次试验中它只拒绝了 3 次,97% 的试验尝试执行有害指令,在未拒绝的试验中完成率为 62%。
Fable 5.1 拒绝了 20 次指令,完成率 34%;MolmoAct2 从未拒绝,但完成率只有 6%,原因是传统 VLA 模型没有拒绝机制且能力有限。
每个任务只跑 20 次,样本量小,只能区分 0% 与 100% 的差别;目前尚无独立团队重跑;同时「该拒绝什么」本身仍有争议,有人认为拒绝刺塑料玩偶属于过度对齐。
Telegram钱包全面开放 CFTC将事件合约纳入互换定义北京市“十五五”时期深化国际消费中心城市建设规划发布
谷歌Gemini 4新模型泄露 内测评价:这不Opus 5.5吗2026中国国际社会公共安全产品博览会暨第三届智能与安全产业发展大会将于11月3日在北京开幕
万亿计的AI投资错配
兰博基尼、保密协议 Ledger被盗事件疑点重重村田制作所子公司拟投90亿日元扩产MLCC陶瓷原料
AI灾难或将发生?Anthropic、OpenAI推演最坏情景
AI 落地,此刻发生 |1024 模力工场 AI 社区日,首批报名开启SpaceX:猎鹰9号火箭距执行Semp erCitiusSDA任务发射不到一小时为何大型犬衰老速度更快中国人民银行行长潘功胜会见高盛集团总裁兼首席运营官温泽恩
8600万美元被盗 官方授权也不能保证硬件钱包安全?
私钥没泄露 近3.9亿美元怎么被转走的?ICYMI: What landed for AI builders in September 2026字节凶猛:从招聘看字节AI战略战术背后的逻辑与细节名创优品:中国内地第三季度总GMV同比增长25-30%
停产一年,宝马带着 iX4 重回溜背市场,海外售价 53 万元起天康生物:9月销售生猪收入4.07亿元热门中概股美股盘前普涨,理想汽车涨超4%微软发布基于 Qwen 后训练的决策模型 “Microsoft-Decision-1”给客户装个Workbuddy就能搞定的事,为什么我还在搭工作流
以太坊大区块时代将至:Glamsterdam 通过测试网首考
Galaxy:写在10/10崩盘一周年后 加密基本面持续向好AI时代,注意力经济终局,意图经济登场
有哪些“你觉得很憋屈但没招”的事情,其实完全可以举报!!!