小米AI手机折叠屏原型机本地运行大模型的生成速度是多少?
实测生成速度约 303 tokens/s,峰值可达 330 tokens/s。

#欢迎关注爱范儿官方微信公众号:爱范儿(微信号:ifanr),更多精彩内容第一时间为您奉上。
小米发布玄戒 O3、O100 和 D100 三颗自研芯片,并在技术沟通会上展示了搭载这些芯片的原型机。实测中,折叠屏原型机断网状态下本地运行 MiMo 3B 模型,生成速度可达 303 tokens/s,响应迅速;桌面计算终端 AI Cube 则配备 80GB 内存,本地部署 120B 大模型,可完成代码生成等复杂任务,并支持 3B 和 120B 双模型切换。
实测生成速度约 303 tokens/s,峰值可达 330 tokens/s。
AI Cube 内置 80GB 内存,本地部署 120B 参数大模型,并支持 3B + 120B 的快慢双模型切换。
黄仁勋为微软站台:没有 Windows 就不会有英伟达,Satya 当场“讨市值”澳门大学预计未来5年学生规模逾2.2万人七部门:推动电商领域高水平开放特斯拉弃用“自动驾驶”命名,以争取欧洲监管批准
硬件钱包接连出事 审计得交给AI干了
新款理想 i6 六项升级公布,旗舰配置下放,要做「全球爆款」!特斯拉在欧洲将 Full Self-Driving 改名为 Tesla Assisted Driving
Citrini:区块链终于迎来它的时刻 怎么选择投资组合被字节开除的AI实习生,刚刚融资2个亿13只低估值个股推出大手笔回购或增持计划