增加测试时推理能提高LLM交易的净收益吗?
论文发现不能。在DeepSeek、GPT和Gemini三个模型家族中,额外推理并未可靠提升扣除交易成本后的净组合收益。
(翻译)思考的代价:测试时推理在LLM交易中能带来回报吗?
Abstract page for arXiv paper 2609.30705: The Price of Thought: Does Test-Time Reasoning Pay in LLM Trading?
该论文研究大语言模型在金融交易中增加测试时推理是否带来经济回报。作者对DeepSeek、GPT和Gemini家族模型进行受控实验,固定信息、提示与组合构建方式,覆盖美国股票一年数据、三种输入条件及80多万条资产预测。结果显示,额外推理并未可靠提升扣除交易成本后的净组合收益;DeepSeek表现非单调,重复生成下效应与组合选择也不稳定。作者建议部署前逐任务验证。
论文发现不能。在DeepSeek、GPT和Gemini三个模型家族中,额外推理并未可靠提升扣除交易成本后的净组合收益。
研究覆盖DeepSeek、GPT和Gemini家族的代表性LLM,使用美国股票一整年数据,包含数值、可识别新闻和掩码新闻三种输入条件,涉及超过80万条资产预测。
作者建议在部署前对每个任务进行验证,因为额外推理可能改变金融决策,但不一定可靠改善其经济价值。
金色Web3.0日报 | Starknet拟升级为L1 2027年抗量子
美债抛售红灯:期限溢价破十年高位 脱离美联储路径DeepSeek Harness 桌面端来了!带你拆解核心机制英国拟未来四年投,10亿英镑扶持创新集群8点1氪丨特朗普买入Meta股票;山姆宣布拟限制亲友卡绑定;豆包开通水、电、燃气等生活缴费功能GMIF 2026:日均140万亿Token调用,正在改变SSD的能力与分工亚马逊云科技在 Aurora DSQL 中引入外键约束商务部欧洲司负责人解读中欧贸易投资磋商机制第二次例会成果
硬件钱包接连出事 审计得交给AI干了日本美滨核电站3号机组反应堆重启赛力斯9月产销快报 全新一代问界M9系列16周累计交付破4万
代币化革命背后闪电仓赛道,为什么惠宜选要做自有品牌?北京:增加人工智能手机和电脑、智能机器人等新一代智能终端产品有效供给Agent 落地核心:真正决定上限的是 Harness 闭环,不是模型纳芯微推出小型化封装的数字隔离器和隔离接口
Grayscale:低成本智能体AI将推高算力需求超110台中国AR眼镜为WTTC全球峰会提供实时翻译服务今年白云机场口岸出入境客货航班超10万架次,创历史同期新高成年人要的「安心」,有时是一支笔给的
Uniswap v4 Hook攻击向量解析与检测方法人社部:力争到2030年技能人才占就业人员比例升至35%大厂卷 Jarvis,Samantha却在恋爱影游里冒了头?App工厂,才是AI时代最被低估的生意
以太坊主网和L2实现跨链原子交易深港“全天候通道”升级 新皇岗口岸5分钟便捷通关Nano Banana 2.1 深度实测:4K 直出、中文排版大进步,连续改图的坑也要看清