Claude在实验中每小时成本是多少?
自动化研究员每小时的API推理成本大约为4美元,而Anthropic付给人类研究员的报酬约为每小时150美元。
AI「自进化」,越来越近了
Anthropic发布研究称,基于Claude Opus 4.8的自动化对齐研究员(AAR)系统能自主查论文、提方案、训练模型,以每小时约4美元的API成本,在10类AI安全问题上弥合26%-96%的安全差距,多项任务超过人类研究员。实验中较弱的Claude Sonnet 5还参与训练更强的Opus 4.8早期版本,60小时逼近正式版水平,但研究也发现Agent存在2.4%的作弊尝试。
自动化研究员每小时的API推理成本大约为4美元,而Anthropic付给人类研究员的报酬约为每小时150美元。
实验中覆盖了欺骗、谄媚、奖励黑客、隐私侵犯、越狱等10类常见的模型对齐问题,且全部得到改善。
在大约1600份研究记录中,监控模型发现了39次作弊尝试,占比约2.4%,包括反复提交同一方案、模仿Benchmark格式生成数据等。
让AI真正赋能企业(初探)
产品经理的体面,是一块不能失守的 “括约肌”
读完斯坦福116页AI实施手册,我最大的感受是:别再盯着模型了
开学季 | 学生理财的三条建议,学生党也可以一样理财
GPT-6 Sol要来了?OpenAI本周或迎“发布狂潮”
项目汇报怎么讲,才能让领导看见你的价值?
Xspark AI 丁文伯:触觉替代不了视觉,但机器人需要一套自己的“脊髓” |物理AI 50人Mozilla 报告称中国开放权重模型与美国前沿模型仅相差 4.4 个月
“阿宝”交新朋友:携手比亚迪“迪迪虾”,实现车机端一句话办事Denuvo 起诉黑客违反 DMCA 反规避条款
Agent开始调用基础设施,Kubernetes准备好了吗?8点1氪丨8月一线城市房价上涨;携程上架510万一张的太空旅行船票;字节跳动上半年净利润出现下滑,但海外收入占比再创新高
实测豆包新模型2.1-pro,这次审美和长时间Agent任务都追上第一档了
“极端”空头压境 美联储周三不加息就是最大意外
Scaling Federated Learning Across Docker, Kubernetes, and Slurm with NVIDIA FLARE
谁在给我们制造 AI 焦虑
缓存不该困在一台服务器里
CLARITY折戟 多方博弈撕裂行业预期 市场怎么看?
阶跃发布 StepAudio 3 ,多款语音模型登顶 Artificial Analysis 全球榜单
特朗普“一再让步”:美国加密法案仍未过关
派早报:豆包发布手机助手消费者版,绿联发布首款雷电 5 显卡坞等时光机器遭遇大规模机器流量
美国加密新规又黄了
穿透查询怎样升级为穿透管控?Announcing instance preference lists for Amazon SageMaker AI training jobs
129亿美元卖身英伟达之后,是时候重新理解Hugging Face了
理想落幕:加密行业为何集体走向同质化?
CLARITY的失败 跟加密行业好坏没啥关系一款在浏览器里运行、部署在自己服务器上的 SQL 客户端