雷峰网 发布于 09/01 16:34

阿里开源 Qwen3.8-27B 本地实测:性能很强,但 Agent 适配仍待补课

查看原文

资讯摘要

    作者丨 吴海明 何宇轩     编辑丨李娜 岑峰                                                                        

AI 摘要

雷峰网对阿里开源的Qwen3.8-27B模型进行本地实测,从标准部署、量化部署到Agent场景多维测评。结果显示其性能强劲,标准部署下vLLM与SGLang吞吐超40 token/s,3bit至6bit量化质量稳定,Agent任务质量满分但token消耗与耗时极高,复杂任务拆解与执行控制不足,需工程化约束才能作为高效Agent底座。

AI 问答

Qwen3.8-27B在标准部署下哪款框架吞吐表现最好?

测试中vLLM平均吞吐约41.77 token/s,SGLang约40.06 token/s,两者基本在同一档,明显优于Llama.cpp的23.50 token/s。

量化到多少bit仍然能保持Qwen3.8-27B的回答质量?

在本轮的7道文本任务中,3bit至6bit均拿到满分14/14,2bit出现事实修正错误,8bit也有类似问题,16bit则在篇幅控制上失守。

Qwen3.8-27B在Agent场景的主要问题是什么?

它完成9个任务耗时约6小时17分钟,消耗近1400万token,其中3D网站生成单题就烧掉1153万token。问题在于任务拆分过细但单步目标过重、上下文反复回灌,导致大量空转和算力浪费。

打开原文

更多资讯

和Jeff Dean押注同一方向,27岁清华助理教授创业,两个月融资数亿36氪 · 09/16 15:58HYROX比赛腹泻这事,运动员拼归拼,但主办方不能装看不见果壳网 · 09/16 23:15Claude在英伟达内部被限用,黄仁勋告诉特朗普:我们不会让AI发展放缓发生InfoQ 中文 · 09/16 00:01清华稳准智能联合发布LimiX-2,结构化数据基础模型登顶国际评测榜单雷峰网 · 09/16 16:05首个AIGC长片大赛!RunningHub单项大奖100万,科幻IP免费改编量子位 · 09/15 15:48豆包手机明日开卖,AI能帮你操作App了吗?36氪 · 09/15 22:32清华稳准智能联合发布LimiX-2,结构化数据基础模型登顶国际评测榜单量子位 · 09/16 14:32AI 减速还是不减速:一场周末点燃的行业与政府对垒金色财经 · 09/15 12:06Xspark AI 丁文伯:触觉替代不了视觉,但机器人需要一套自己的“脊髓” |物理AI 50人雷峰网 · 09/15 15:52我和我的 AI 手机吃了 3 顿饭爱范儿 / APPSO · 09/16 12:04当AI能解千禧难题,再次证明答案不再是门槛人人都是产品经理 · 09/15 09:44超级智能体“迪迪虾”上车,比亚迪携手阿里云推进智能座舱升级雷峰网 · 09/15 11:58“阿宝”交新朋友:携手比亚迪“迪迪虾”,实现车机端一句话办事雷峰网 · 09/15 16:45Build an AI-powered product tagging system with Amazon SageMaker serverless model customizationAWS Machine Learning Blog · 09/16 00:11读完斯坦福116页AI实施手册,我最大的感受是:别再盯着模型了人人都是产品经理 · 09/15 12:14拼多多链接裂变玩法人人都是产品经理 · 09/15 09:20推特创始人谈“AI减速”论:前沿不属于任何一家公司金色财经 · 09/15 17:30地平线第1500万颗征程芯片搭载大众 ID. AURA T6,HSD V2.1 即将推出量子位 · 09/15 21:32产品定义意义上的一级场景:四维模型人人都是产品经理 · 09/16 14:07Anew Labs已完成 2.9 亿美元融资,红杉中国、高瓴、IDG、五源、高榕等参与雷峰网 · 09/16 14:28HTTP 新增 QUERY 方法:有人叫好,也有人质疑“这不就是 GET?”InfoQ 中文 · 09/15 21:00Denuvo 起诉黑客违反 DMCA 反规避条款Solidot · 09/16 23:27数亿元!前京东副总裁“消失”4年:不造会跑的天工,他在仓库里给人形机器人“占工位”雷峰网 · 09/15 15:14从前沿技术到产业资本,2026产业未来大会看见「深水之上」36氪 · 09/15 15:04支付宝 xUI -- “阿宝”背后的 Agentic 终端交互引擎InfoQ 中文 · 09/16 02:27How NVIDIA Groq 3 LPX Deterministic Execution Drives Power-Efficient High-Interactivity Inference on NVIDIA Vera RubinNVIDIA Technical Blog · 09/16 00:55Mozilla 报告称中国开放权重模型与美国前沿模型仅相差 4.4 个月Solidot · 09/16 18:30被AI放大的光学「戏份」,让「配角」舜宇的生意越做越大雷峰网 · 09/16 18:33破局产品同质化:长期主义的产品突围之路人人都是产品经理 · 09/16 14:12旗舰SoC进入融合计算时代,天玑9600 Pro首创AI原生架构!雷峰网 · 09/15 21:01