StepAudio 3 系列包含哪五款模型?
包括面向实时语音交互的 StepAudio 3 Realtime、语音识别模型 StepAudio 3 ASR、真人级语音生成模型 StepAudio 3 TTS、整合人声音效环境声与背景音乐的 StepAudio 3 Gen,以及面向音乐创作的 StepAudio 3 Music。

9月15日,阶跃发布新一代语音大模型 StepAudio 3 系列,一次性推出 StepAudio 3 Realtime、StepAudio 3 ASR、StepAudio 3 TTS、StepAudio 3 Gen 和 StepAudio 3 Music 五款模型,覆盖实时语音交互、语音识别、真人级语音生成和音乐创作等场景。其中,多款模型在 权威 第三方 AI 模型评测机构 Artificial Analysis 榜单中位列全球第一。
9月15日,阶跃发布新一代语音大模型 StepAudio 3 系列,一次性推出 Realtime、ASR、TTS、Gen 和 Music 五款模型,覆盖实时语音交互、语音识别、真人级语音生成与音乐创作等场景,多款模型在第三方评测机构 Artificial Analysis 榜单中位列全球第一。目前五款模型均已上线阶跃星辰开放平台。
包括面向实时语音交互的 StepAudio 3 Realtime、语音识别模型 StepAudio 3 ASR、真人级语音生成模型 StepAudio 3 TTS、整合人声音效环境声与背景音乐的 StepAudio 3 Gen,以及面向音乐创作的 StepAudio 3 Music。
该模型在 Conversational Dynamics 榜单中以 98.9% 的综合得分排名全球第一,并在 Speech Reasoning 榜单中同样位列全球第一。
在 Artificial Analysis 非流式语音识别准确性榜单中,StepAudio 3 ASR 的词错误率(WER)为 1.7%,并列全球第一。
当罗永浩站在群众的对立面
美股太贵 该加仓新兴市场吗?
川普让步了 为何Clarity法案还遭到全体民主党人反对
一边喊停一边敲钟:硅谷AI巨头到底在怕什么
英伟达开始限制Claude使用了
飞书与豆包工作合体后首亮相:Agent 能进群,还能帮你写周报、做PPT
读完斯坦福116页AI实施手册,我最大的感受是:别再盯着模型了AI大模型工场2026 AI产业生态大会今日举办,大咖同台共探智能生长与产业共生
产品经理的体面,是一块不能失守的 “括约肌”
OpenAI万亿IPO推迟背后 四本账与三条投资路径
自主团队被捧过头了?Simon Rohrer 直言:你们交付的根本不是产品
Anthropic CEO自爆行业黑幕
DeepSeek-V4.1-Flash 的最佳 Harness 搭档,我觉得可能是 Claude CodeSteam Frame 起售价 1059 美元
AI健康走进百姓餐桌,蚂蚁阿福推出AI饮食分功能清华稳准智能联合发布LimiX-2,结构化数据基础模型登顶国际评测榜单
在金融支付系统中实施混沌工程:来自企业级 ECS 部署的经验教训Announcing instance preference lists for Amazon SageMaker AI training jobs
月下载暴增366%,上海真人社交公司切入东南亚AI陪伴,AI角色也能“奔现”
CoinShares Q2 挖矿季报:矿企倒贴钱退出
Stella:“显化”想要的人生,60天35万美元月收入
破局产品同质化:长期主义的产品突围之路B站AI无限竞技场今日上线!全球百大AI模型同场竞技,GPT-6高居榜首
Scaling Federated Learning Across Docker, Kubernetes, and Slurm with NVIDIA FLARE
510万一张!携程上架太空旅行船票:已有681人购买,还得自己买保险;娃哈哈因拖欠员工公积金被查封办公楼;华为放权!问界将由赛力斯主导圆桌:探路·产业分工的新图谱,看到新未来——国家力量如何转化为产业价值 | 36氪 2026产业未来大会
当AI能解千禧难题,再次证明答案不再是门槛
CLARITY法案为何倒在参议院门口?这主流如你所愿
亚太唯一!腾讯云首次入选IDC MarketScape 全球托管边缘服务领导者类别
加密行业今年最重要的一天 可能就是明天