← 资讯列表
资讯

阶跃星辰发布 StepAudio 3 语音大模型系列,多项全球第一

📅 2026/9/15 08:00:00👁 1 阅读⏱ 约 3 分钟

一句话:9 月 15 日阶跃星辰发布新一代语音大模型 StepAudio 3 系列,一次性推出 Realtime、ASR、TTS、Gen、Music 五款模型,覆盖实时交互、识别、真人级生成与音乐创作,多项第三方榜单登顶全球第一。

背景

  • 语音模型竞争从单项能力(识别或生成)走向「听—说—理解—执行」全栈;StepAudio 3 把语音推理与任务执行并入实时链路。

核心要点

  • 五款模型:Realtime / ASR / TTS / Gen / Music,均已上线阶跃开放平台。
  • Realtime 原生全双工,语音推理与工具调用并行,长任务异步执行。
  • Artificial Analysis 对话动态评测 98.9% 综合得分全球第一,语音推理评测同样第一。
  • ASR 词错误率 1.7%(非流式),并列全球第一。

为什么重要

  • 国产语音模型在权威第三方榜单包揽多项第一,标志全栈语音能力进入第一梯队。
  • 语音推理 + 执行使语音 assistant 从「对话」走向「代办」。

关键事实速记

  • 发布:2026-09-15
  • 五款:Realtime/ASR/TTS/Gen/Music
  • 对话动态:98.9% 全球第一
  • ASR WER:1.7%

📂 原文链接:查看原文 →

← 返回资讯列表 AI8899 · 内容仅供学习参考