阶跃发布StepAudio3系列模型:五款模型同步上线开放平台

阶跃星辰今日正式发布StepAudio3系列模型,包括StepAudio3Realtime、StepAudio […]

阶跃星辰今日正式发布StepAudio3系列模型,包括StepAudio3Realtime、StepAudio3ASR、StepAudio3TTS、StepAudio3Gen和StepAudio3Music,五款模型均已上线阶跃星辰开放平台,其中多款模型在Artificial Analysis榜单中位列全球第一。该系列覆盖真人级语音生成、完整音频生成、实时语音交互、复杂语音理解及音乐创作等场景。

QQ20260915-162556.jpg

其中,StepAudio3Realtime支持原生全双工实时对话,可同时理解语义、语气、情绪、副语言及环境声音,并支持推理与语音生成并行、Tool Call及长任务异步执行。在Artificial Analysis Conversational Dynamics榜单中综合得分98.9%,位列全球第一;语音推理准确率99.7%,同样排名全球第一

StepAudio3ASR融合语音识别与大模型上下文理解能力,支持中文、英文、方言、中英混说、长音频及医疗、法律、金融等专业场景,WER仅1.7%,并列全球第一。StepAudio3TTS则强化音色、语调、节奏、停顿及笑声、迟疑、结巴等副语言表现,支持流式生成,面向实时语音交互。

QQ20260915-162601.jpg

此外,StepAudio3Gen可统一生成角色人声、音效、环境音和背景音乐,并支持多角色及声音时序控制;StepAudio3Music支持歌曲创作、清唱配乐、翻唱及基于ABC记谱法的多轮创作,可通过自然语言控制曲风、旋律、节奏、乐器和情绪。整体来看,StepAudio3正将语音模型能力从单一识别或生成拓展至完整音频内容生产与实时智能交互。

CXOU AI 未来大会 · 报名通道限时开启
💬 评论
🔗 本文链接

📰 你可能也喜欢

数智化转型网每日AI资讯 资讯

GPT-6 Astra测试数据罗生门:OpenAI频繁修改成绩引「刷榜」质疑,大模型基准测试信任危机爆发

AI资讯AI新闻资讯正文GPT-6 Astra测试数据罗生门:OpenAI频繁修改成绩引「刷榜」质疑,大模型基准测试信任危机爆发发布于AI新闻资讯发布时间 :2…
📅 09-20 · 👁 2026年9月20日
数智化转型网每日AI资讯 资讯

微软发布 MAI-Image-2.6-Flash:图像生成速度提升2.8倍,成本降低逾50%

AI资讯AI新闻资讯正文微软发布 MAI-Image-2.6-Flash:图像生成速度提升2.8倍,成本降低逾50%发布于AI新闻资讯发布时间 :2026年9月…
📅 09-20 · 👁 2026年9月20日
数智化转型网每日AI资讯 资讯

OpenAI首个达“关键”门槛的Astra因能力太强遭安全限速

OpenAI下一代模型Astra将推出,但严格限制其网络安全功能。该模型为首个达《准备框架》“关键”网络安全能 […]
📅 09-20 · 👁 2026年9月20日
数智化转型网每日AI资讯 资讯

OpenAI 发布 GPT-6Astra,黄仁勋称 AGI 已经到来

AI资讯AI新闻资讯正文OpenAI 发布 GPT-6Astra,黄仁勋称 AGI 已经到来发布于AI新闻资讯发布时间 :2026年9月7号 9:34阅读 :1…
📅 09-20 · 👁 2026年9月20日
数智化转型网每日AI资讯 资讯

Marvis上线自定义模型功能,支持接入Kimi、智谱GLM等主流模型

腾讯AI助手Marvis上线“自定义模型”功能,用户可接入腾讯云、阿里云、DeepSeek、Minimax、K […]
📅 09-20 · 👁 2026年9月20日
数智化转型网每日AI资讯 资讯

Claude攻克黎曼猜想历史大关,人类顶尖学者与机器联手书写跨物种神话

AI资讯AI新闻资讯正文Claude攻克黎曼猜想历史大关,人类顶尖学者与机器联手书写跨物种神话发布于AI新闻资讯发布时间 :2026年9月7号 9:36阅读 :…
📅 09-20 · 👁 2026年9月20日