阿里下一代Qwen模型计划达到多大规模?
文章称,Qwen4系列即将到来,Qwen4之后的Qwen4.5和Qwen5计划进一步迈向5T至10T参数规模。

作者丨胡敏 编辑丨刘伟 &
雷峰网观察云栖大会上阿里大模型路线,梳理Qwen下一代参数规模、Qwen4至Qwen5迭代思路、模型参与研发与芯片适配的RSI实践,以及视频、图像、语音、音乐、世界模型等多模态产品升级。
文章称,Qwen4系列即将到来,Qwen4之后的Qwen4.5和Qwen5计划进一步迈向5T至10T参数规模。
文章提到,阿里通过稀疏注意力、线性注意力和外接记忆等新架构,让Qwen3.8-Flash每次推理只激活6B参数,并降低训练和输入成本。
文章称,阿里预告下一代视频生成模型将于11月亮相,并发布或升级Qwen-Image-3.1、Qwen-Audio-3.1、HappyShrimp1.1和HappyOyster 2.0 Preview等模型。
Cloudflare 详解从 WordPress 迁移至 EmDash 的过程
谭谈:央行为什么发布关于人民币汇率的政策立场
卖手机的 来抢稳定币入口了
等 AI 干活太无聊?我给 DeepSeek Harness 写了个「合成大鲸鱼」,已开源
Building Reliable Data Analytics Agents: Lessons from the KDD Cup
美联储会议:预计年内还加 1 次 但暗示 10 月不急
2万亿美元估值靠什么撑?Anthropic 核心技术负责人:蒸馏会毁掉前沿研发,中美 AI 竞赛不会单边暂停
虎牙推出AI游戏互动App“BinkBink”,寻找直播外的新增长点An Empirical Study of Agent Skills' Downstream UtilityLearning How to Search for Plans with Exponentially Less Space
Bitget要求封禁黑客地址:THORChain有义务配合吗?
阿里开源了个神器,给WorkBuddy、豆包挑毛病
TOKEN2049到生态共建:火币HTX连接全球加密行业力量大模型原生智能体手机STEPX Neo将于10月13日正式发布
谷歌为何押注RSI?
辱骂将遭封号:Anthropic首次让AI有权主动挂断对话Beyond Imitation: A Framework and Benchmark for LLM-Assisted Peer Review
鸿蒙版本的小小机器人APP开放源码啦
迁移技术机理层|负迁移发生的底层诱因
App+1|所得即所见,更适合中文的字体预览工具:Anyway.FontsEnabling Dynamic Computation in Looped LMs
腾讯再出手,WorkBuddy 想做 AI 时代的 Office!Google 多个国家顶级域名被劫持Curating Always-Loaded Context for LLM Agents: A Capacitated Assortment Model with Censored Feedback
DeepSeek三年融资史:前两年自己养,今年资本抢着送钱深创投、元禾原点押注一家水下机器人,9个月内已完成5轮融资丨36氪首发
比特币能抗住8万吗?不妨看看这些数据
花旗:美联储“鸽派意外”正酝酿 核心通胀2%是关键
“AI央行”英伟达的“千亿资本局”