QAD 与 PTQ 有何区别?
PTQ 是后训练量化,直接将模型权重量化到低精度;QAD 在此基础上用原始全精度模型作为教师,通过蒸馏损失指导量化学生模型训练,从而恢复激进量化造成的精度损失。
(翻译)使用 NVIDIA Model Optimizer 通过 QAD 开发 Nemotron 3.5 Lightning NVFP4

Teams customize their models to hit their targets for latency, speed, memory, and compute. With the open NVIDIA Nemotron family of models…
NVIDIA 技术博客介绍如何使用 NVIDIA Model Optimizer,通过量化感知蒸馏(QAD)开发 Nemotron 3.5 Lightning NVFP4 模型。文章详细说明从 PTQ 到 QAD 训练的两阶段流程,包括五种量化配方、训练配置与蒸馏数据选择。该方法将模型从 66GB 压缩至 22GB,并实现最高约 4 倍吞吐提升,同时恢复激进量化带来的精度损失。
PTQ 是后训练量化,直接将模型权重量化到低精度;QAD 在此基础上用原始全精度模型作为教师,通过蒸馏损失指导量化学生模型训练,从而恢复激进量化造成的精度损失。
模型从 66GB 的全精度检查点压缩至 22GB,可带来最高约 4 倍的吞吐量提升,同时保持精度。
可使用 NVIDIA Model Optimizer 对 Hugging Face 模型执行 PTQ 量化,再参考端到端 QAD 示例进行蒸馏训练,涉及校准数据、序列长度和量化配方等配置。
OpenAI 高管亲述:我们是怎么在一周内做出 Jev 竞品的中金黄金等在河南成立黄金投资公司,注册资本2000万元Let's Encrypt 从 2027 年起切换到有效期为 64 天的证书新思科技与亚马逊达成多年期定制芯片战略IP协议
这三个摄影 App, 配得上你全新的 iPhone 18 ProApp工厂,才是AI时代最被低估的生意Cloudflare 公共 DNS 服务不需屏蔽盗版网站域名2026中国国际社会公共安全产品博览会暨第三届智能与安全产业发展大会将于11月3日在北京开幕近期海外进出口传闻的政策限制对公司是否有影响? 天孚通信回应国内金饰价格集体上涨亚马逊云科技在 Aurora DSQL 中引入外键约束北京:加大新能源汽车推广力度 培育汽车消费新增长点
黄仁勋为微软站台:没有 Windows 就不会有英伟达,Satya 当场“讨市值”商务部欧洲司负责人解读中欧贸易投资磋商机制第二次例会成果乘联分会:9月1-30日全国乘用车新能源市场零售114.1万辆,同比去年9月同期下降12%
有哪些“你觉得很憋屈但没招”的事情,其实完全可以举报!!!贾健旭卸任上汽大通法定代表人Stripe创始人:AI agent 将重写整个互联网欧盟轮值主席国提议将2028-2034年欧盟预算削减8%至1.6万亿欧元人社部:将构建技能导向的薪酬分配制度,完善治理欠薪长效机制多部门:汽车生产企业不得作虚假、夸大或引人误解的宣传特朗普政府要求AI公司在发生安全事件后立即上报13只低估值个股推出大手笔回购或增持计划Zentrola 1.1.0 发布:应用接入、成本核算与月度 Token 配额AI时代,注意力经济终局,意图经济登场中国人民银行行长潘功胜会见高盛集团总裁兼首席运营官温泽恩美“天鹅座”货运飞船结束任务 离开国际空间站