论文提出的自我演化边界是什么?
论文主张将自我演化限制在运行时 harness,包括指令文本、工具调用逻辑和原语组合,模型权重保持固定,以便每次适配都可形成带原因和测试的差异记录。
(翻译)作为唯一可变表面的 Harness:信用流程中受合规约束的 LLM Agent 自我演化及可测量准入门控
Abstract page for arXiv paper 2610.10629: The Harness as the Only Mutable Surface: Compliance-Bounded Self-Evolution of LLM Agents in Credit Pipelines, with a Measured Admission Gate
这篇 arXiv 论文讨论在信用评分流程中限制 LLM Agent 自我演化的方式:仅允许运行时 harness 变更、保持模型权重固定,并通过带哈希链记录的准入门控审查部署。模拟结果显示,该门控可减少有害变更并在多类规则重解释场景下恢复误报率。
论文主张将自我演化限制在运行时 harness,包括指令文本、工具调用逻辑和原语组合,模型权重保持固定,以便每次适配都可形成带原因和测试的差异记录。
在三类监管重解释、三种严重度和每类 10 个种子的模拟中,门控从 7449 个候选变更中准入 144 个,未使留存历史错误恶化,并在低、中严重度场景中将误报率恢复到 oracle 水平。
论文将机制映射到欧盟 AI Act 对高风险信用评分的规定,并指出 2026 年 4 月美国模型风险指南将 agentic AI 排除在适用范围之外。
App Store 生态规模五年翻倍,助力中国开发者走向全球Not Every Call Needs a Frontier Model: Per-Call-Site Evaluation of Small Language Models in a Deployed Agentic Home-Automation SystemChatGPT踢到铁板了!能破解千禧数学难题,但论文复现率低至13.98%?
谁来为 SUI 的“豪门利好”提供真实买盘?How Could AI Eliminate Humanity? A Failure-Mode Analysis of Civilizational Risk吉利智充技术正式发布,重塑全球补能新标杆
SpaceX、博通、甲骨文天量发债:美国债市“挤爆”Curating Always-Loaded Context for LLM Agents: A Capacitated Assortment Model with Censored Feedback
产品经理成长指南:从“做功能”到“对结果负责”
加密货币如何从根本上重塑金融体系
全行业迁移治理层|产业落地的风控基线校准AdaGuard: Enhancing Safety and Policy Compliance with Reasoning-Enabled LLM-As-A-Judge Guardrails
Grok Bot免费Opus 5.5直连 第三方模型付费墙被砸开美国男子因利用 AI 生成音乐和机器人账号欺诈播放被判 18 个月
从「工具」到「智能体」:CARES 4.0在港发布,刘宏斌谈医疗AI如何走进临床
跨域顶层监管层|监管者自身的跨域审计规则
卖手机的 来抢稳定币入口了
80亿美元芯片卖掉再租回来,亚马逊图什么?
谷歌为何押注RSI?美光台工厂工会获得罢工权,支持率 99%
华尔街不打烊:即将开启24小时工作制
TypeScript 终于能编译成原生程序了?启动快 12 倍,运行却慢 7.5 倍《柳叶刀》研究表明:AI 有望改善医患关系
豆包新增“生活缴费”,会是下一个超级App吗?Learning to Report Unsafe Tasks in a Multi-Agent Game
从「小而专」切入,3C 卖家如何在东南亚做深配件生意
Grok Bot 玩法 01:生成 AI 早报视频的提示词
“AI央行”英伟达的“千亿资本局”
中美大模型差距重新拉大了?
对话框不是Personal Agent的终局:Eazo让图形界面属于每个人