每日AI资讯|阶跃发布StepAudio3系列模型:五款模型同步上线开放平台

阶跃星辰今日正式发布StepAudio3系列模型,包括StepAudio3Realtime、StepAudio […]

阶跃星辰今日正式发布StepAudio3系列模型,包括StepAudio3Realtime、StepAudio3ASR、StepAudio3TTS、StepAudio3Gen和StepAudio3Music,五款模型均已上线阶跃星辰开放平台,其中多款模型在Artificial Analysis榜单中位列全球第一。该系列覆盖真人级语音生成、完整音频生成、实时语音交互、复杂语音理解及音乐创作等场景。

QQ20260915-162556.jpg

其中,StepAudio3Realtime支持原生全双工实时对话,可同时理解语义、语气、情绪、副语言及环境声音,并支持推理与语音生成并行、Tool Call及长任务异步执行。在Artificial Analysis Conversational Dynamics榜单中综合得分98.9%,位列全球第一;语音推理准确率99.7%,同样排名全球第一

StepAudio3ASR融合语音识别与大模型上下文理解能力,支持中文、英文、方言、中英混说、长音频及医疗、法律、金融等专业场景,WER仅1.7%,并列全球第一。StepAudio3TTS则强化音色、语调、节奏、停顿及笑声、迟疑、结巴等副语言表现,支持流式生成,面向实时语音交互。

QQ20260915-162601.jpg

此外,StepAudio3Gen可统一生成角色人声、音效、环境音和背景音乐,并支持多角色及声音时序控制;StepAudio3Music支持歌曲创作、清唱配乐、翻唱及基于ABC记谱法的多轮创作,可通过自然语言控制曲风、旋律、节奏、乐器和情绪。整体来看,StepAudio3正将语音模型能力从单一识别或生成拓展至完整音频内容生产与实时智能交互。

CXOU AI 未来大会 · 报名通道限时开启
💬 评论
🔗 本文链接

📰 你可能也喜欢

数智化转型网每日AI资讯 资讯

每日AI资讯|马斯克:Grok 4.8 本周完成训练,参数量冲到 2.5 万亿,全新 C++ 软件栈喂出来

xAI 首席执行官埃隆·马斯克今天在 X 平台透露,Grok 4.8 将是一款参数量达 2.5 万亿的 AI […]
📅 09-19 · 👁 2026年9月19日
数智化转型网每日AI资讯 资讯

每日AI资讯|-V4.1-Flash上线千问AI平台,API与Token Plan同步开放

DeepSeek-V4.1-Flash近日上线千问AI平台,API服务与Token Plan同步开放。开发者可 […]
📅 09-19 · 👁 2026年9月19日
数智化转型网每日AI资讯 资讯

每日AI资讯|爆料称 DeepSeek 下一波大模型将至:3 万亿参数,性能剑指 GPT-6 Astra

本周 DeepSeek 发布了 V4.1 Flash,这个大模型架构变化之大,完全可以称得上是 V5,但 De […]
📅 09-19 · 👁 2026年9月19日
数智化转型网每日AI资讯 资讯

每日AI资讯|WorkBuddy 升级 PPT 能力:一句话生成可上台版,原文件可续改

腾讯 WorkBuddy 于9月14日宣布升级 PPT 生成能力,主打“一句话出初稿、原文件续改、不重做整份” […]
📅 09-19 · 👁 2026年9月19日
数智化转型网每日AI资讯 资讯

每日AI资讯|蓝虫具身发布模块化人形机器人“小白”,0. 98 万元起售

西安交通大学科技成果转化企业蓝虫具身于9月14日正式发布了新一代模块化人形机器人Mantis Standard […]
📅 09-19 · 👁 2026年9月19日
数智化转型网每日AI资讯 资讯

每日AI资讯|DeepSeek Harness 官方桌面端即将就绪:三大平台支持,用 V4.1 Flash 还是自家最香

8 月中旬 V4 Pro 正式版发布时,DeepSeek 顺带推出了官方配套客户端 DeepSeek Harn […]
📅 09-19 · 👁 2026年9月19日