Qwen3.8-2.4T-A95B 的总参数量和每个 token 激活的参数量分别是多少?
该模型总参数量为 2.4T,每个 token 激活 95B 参数。
(翻译)在 NVIDIA GB300 NVL72 上提供 Qwen3.8-2.4T-A95B(2.4T 参数模型)的可配置推理服务

Alibaba released the open weights for Qwen3.8-2.4T-A95B (Qwen3.8-Max), its largest open-weight model, bringing near-frontier capabilities to the open ecosystem.
阿里巴巴开源了 Qwen3.8-2.4T-A95B(Qwen3.8-Max)权重,这是其最大的开源模型,总参数 2.4T,每个 token 激活 95B,采用细粒度 MoE 与全注意力/线性注意力混合架构,支持最长 100 万 token 上下文和 128K 输出。NVIDIA 与开源生态合作,在 GB300 NVL72 上实现每 GPU 每秒超 4K tokens、每用户每秒超 350 tokens 的 FP8 推理吞吐,并支持 SGLang、vLLM、NIM 等部署。
该模型总参数量为 2.4T,每个 token 激活 95B 参数。
无需额外调优即可实现每 GPU 每秒超过 4K tokens、每用户每秒超过 350 tokens 的吞吐量(FP8 精度)。
支持 SGLang、vLLM、NVIDIA Dynamo 和 NVIDIA NIM 等推理栈,也可使用 NVIDIA NeMo AutoModel 进行后训练微调。
大模型通用答案没有考虑每个人需求中国广核、宁德时代等在陆丰成立新核电公司,注册资本1亿Cloudflare 收购 Deno,Deno 停止开发纳芯微推出小型化封装的数字隔离器和隔离接口
黄仁勋为微软站台:没有 Windows 就不会有英伟达,Satya 当场“讨市值”前8个月我国软件业务收入超10万亿元C盘爆红救星!开源神器 MuRig v1.2.0 发布,支持自定义环境安装路径!日本美滨核电站3号机组反应堆重启:fire::fire:开源接口平台v6.1发布,支持数据插件人类愿意向女性形象的 AI 智能体支付的报酬低于男性形象智能体七部门:构建电商出海良好生态阿里开始给AI算账了:用AI的钱,以后各业务线自己出
这三个摄影 App, 配得上你全新的 iPhone 18 Pro
以太坊主网和L2实现跨链原子交易广合科技:前三季度净利润同比预增100.33%至107.23%公司是否有提价计划?五粮液:不存在固定的价格比值关系Agent 落地核心:真正决定上限的是 Harness 闭环,不是模型机构:预估2031年VCSEL市场需求量将有望达到6.5亿颗OPC企业容易陷入的三个增长误区
兰博基尼、保密协议 Ledger被盗事件疑点重重
Galaxy:写在10/10崩盘一周年后 加密基本面持续向好
森海 Momentum 5 真无线降噪耳机体验:升级无线传输与空间音频,它依然是那个正统 「森海味」
隐私赛道最新进展:从隐私货币到私人金融账户
Tiger Research:2026年三季度加密资产行业投资报告奇瑞汽车旗下合肥智能科技公司增资至1.68亿,增幅1580%海航控股旗下北京新华顺航商贸公司增资至22亿ModStartBlog v11.3.0 安全加固、体验优化,自动化测试更强大近期海外进出口传闻的政策限制对公司是否有影响? 天孚通信回应