
资讯
阶跃星辰发布 StepAudio 3 语音大模型系列,多项全球第一
一句话:9 月 15 日阶跃星辰发布新一代语音大模型 StepAudio 3 系列,一次性推出 Realtime、ASR、TTS、Gen、Music 五款模型,覆盖实时交互、识别、真人级生成与音乐创作,多项第三方榜单登顶全球第一。
背景
- 语音模型竞争从单项能力(识别或生成)走向「听—说—理解—执行」全栈;StepAudio 3 把语音推理与任务执行并入实时链路。
核心要点
- 五款模型:Realtime / ASR / TTS / Gen / Music,均已上线阶跃开放平台。
- Realtime 原生全双工,语音推理与工具调用并行,长任务异步执行。
- Artificial Analysis 对话动态评测 98.9% 综合得分全球第一,语音推理评测同样第一。
- ASR 词错误率 1.7%(非流式),并列全球第一。
为什么重要
- 国产语音模型在权威第三方榜单包揽多项第一,标志全栈语音能力进入第一梯队。
- 语音推理 + 执行使语音 assistant 从「对话」走向「代办」。
关键事实速记
- 发布:2026-09-15
- 五款:Realtime/ASR/TTS/Gen/Music
- 对话动态:98.9% 全球第一
- ASR WER:1.7%
📂 原文链接:查看原文 →
← 返回资讯列表
AI8899 · 内容仅供学习参考