StepAudio 3 系列包含哪五款模型?
包括面向实时语音交互的 StepAudio 3 Realtime、语音识别模型 StepAudio 3 ASR、真人级语音生成模型 StepAudio 3 TTS、整合人声音效环境声与背景音乐的 StepAudio 3 Gen,以及面向音乐创作的 StepAudio 3 Music。

9月15日,阶跃发布新一代语音大模型 StepAudio 3 系列,一次性推出 StepAudio 3 Realtime、StepAudio 3 ASR、StepAudio 3 TTS、StepAudio 3 Gen 和 StepAudio 3 Music 五款模型,覆盖实时语音交互、语音识别、真人级语音生成和音乐创作等场景。其中,多款模型在 权威 第三方 AI 模型评测机构 Artificial Analysis 榜单中位列全球第一。
9月15日,阶跃发布新一代语音大模型 StepAudio 3 系列,一次性推出 Realtime、ASR、TTS、Gen 和 Music 五款模型,覆盖实时语音交互、语音识别、真人级语音生成与音乐创作等场景,多款模型在第三方评测机构 Artificial Analysis 榜单中位列全球第一。目前五款模型均已上线阶跃星辰开放平台。
包括面向实时语音交互的 StepAudio 3 Realtime、语音识别模型 StepAudio 3 ASR、真人级语音生成模型 StepAudio 3 TTS、整合人声音效环境声与背景音乐的 StepAudio 3 Gen,以及面向音乐创作的 StepAudio 3 Music。
该模型在 Conversational Dynamics 榜单中以 98.9% 的综合得分排名全球第一,并在 Speech Reasoning 榜单中同样位列全球第一。
在 Artificial Analysis 非流式语音识别准确性榜单中,StepAudio 3 ASR 的词错误率(WER)为 1.7%,并列全球第一。
BTC电力消耗可能已经见顶 2025年12月或为历史峰值
具透 | 精心优化, 体验感愉悦升华:iOS 27 中值得关注的新特性西门子不造机器人,为什么机器人进厂的故事里总有它?
旧消费品,正长出新生意
基元律动与无问芯穹达成战略合作,推进高质量Token供给与应用
让AI真正赋能企业(初探)
WorkBuddy + 美图设计室,在对话框里就能解决办公设计任务?
场景越多 ≠ 产品越好,:从抽象价值到真实生活的定义结构
Stella:“显化”想要的人生,60天35万美元月收入
早报|iOS27正式推送/比亚迪高管:燃油车在中国没有未来/iPhone 18 Pro渠道降价900元,苹果称不干预
超级智能体“迪迪虾”上车,比亚迪携手阿里云推进智能座舱升级
清晰法案有概率通过?市场可能并未定价Optimizing cost and latency with Amazon Bedrock prompt caching
豆包工作还想反超WorkBuddy?
被AI放大的光学「戏份」,让「配角」舜宇的生意越做越大
QQ 飞车 Agentic 研发转型过程中的Loop Engineering
当我怀念旧版 Edge 浏览器时,我在怀念什么?Fedora 45 Beta 释出一张GPU跑10万原子!分子之心用AI把化学反应“拍”成了电影圆桌:跃迁·AI深流,价值跃升——AI深水时代,从模型竞逐到产业价值涌现 | 36氪 2026产业未来大会58秒出杯,能拉花的咖啡机器人,在全球70国卖出600万杯
川普让步了 为何Clarity法案还遭到全体民主党人反对
Ctenophores Aren’t Just Beautiful. They’re Biological Wonders.日本百岁老人人数首次超过 10 万人
自主团队被捧过头了?Simon Rohrer 直言:你们交付的根本不是产品
渣打给ARB十美元目标价靠什么?
19.98 万元起,吉利银河战舰 700 开启预售,最高 1129 匹马力,还有三电机四驱
CLARITY法案为何倒在参议院门口?这主流如你所愿
具透 | Liquid Glass 设计改进、性能提升……iPadOS 27 中值得一瞥的新特性被英伟达点名的杭州团队,补上了AI for Science的「最后一公里」