论文主要质疑了 AI 开发中的什么常见假设?
论文质疑传统机器学习和 AI 系统通常假设存在单一、确定的基准真相,并把人类标注差异通过聚合处理或视为噪声。
(翻译)谁的基准真相?在人本 AI 中拥抱模糊性
Abstract page for arXiv paper 2610.10805: Whose Ground Truth? Embracing Ambiguity in Human-Centered AI
这篇 arXiv 立场论文讨论人本 AI 中“基准真相”的假设问题,认为许多任务中的人类解释具有合理的多义性,不应简单聚合为单一标签。作者主张建模可能的人类判断解释空间,并区分有意义的模糊性与标注噪声,以影响 AI 的表示、学习、评估、部署和治理。
论文质疑传统机器学习和 AI 系统通常假设存在单一、确定的基准真相,并把人类标注差异通过聚合处理或视为噪声。
作者主张建模合理人类判断的解释空间,同时区分有意义的模糊性与标注噪声,而不是将多样解释压缩成单一目标。
页面显示该论文被 NeurIPS 2026 Trustworthy AI for Good Workshop 接收。
法典终局锁档层|体系自洽与范式边界的闭环校验
TOKEN2049到生态共建:火币HTX连接全球加密行业力量
AI让数学再也回不去那个旧世界了。Verification and Self-Improvement in Agentic AI: Foundations and Limits
跨域顶层监管层|监管者自身的跨域审计规则AdaGuard: Enhancing Safety and Policy Compliance with Reasoning-Enabled LLM-As-A-Judge Guardrails
AICon 北京 2026 议题征集启动:寻找把 AI 做进真实生产的人
近万天猫品牌进入东南亚,Lazada把细分需求变成增长机会
Bitwise:读懂“为AI而生的区块链”NEARARTEX 从 GitHub 下架
Building Reliable Data Analytics Agents: Lessons from the KDD Cup
代码交给AI,心流却回来了:Codex负责人不再怀念手写时代
我用 Vidu Q4 Preview 把奥特曼和 Dario 凑成男团,跳起了 APT
最新FOMC纪要出炉 看今年最后三个月该如何加息
「无驾驶舱」重卡上路,卡尔动力押注无人货运规模化美国计划限制留学生毕业后在美就业Route-Verify-Vote: Procedure-Conditioned Self-Consistency for Mixed-Domain ReasoningDistillation for Incrimination and Distillation for Capabilities黑客利用 AI 攻击韩国银行
孙宇晨应战CZ健身之约:一年塑形请所有人监督
80亿美元芯片卖掉再租回来,亚马逊图什么?加拿大诗人 Anne Carson 赢得诺贝尔文学奖正行创新亮相APRCE 2026,发布全球首个零售物理智能24/7服务解决方案
币安变“股安” Crypto迎来史无前例变革
迁移权责确权层|跨域行为的权属与越界判定
豆包工作新增画布功能,并接入豆包2.1 Lite模型Google 多个国家顶级域名被劫持
Tiger Research:2026年三季度加密资产行业投资报告Humanity's Sixth Sense: Benchmarking Intuitive Visual Reasoning in Multimodal Models
iPhone Duo:苹果,终究还是对强迫症下手了