TAG:Qwen-Audio-3.0-TTS

千问发布语音合成大模型Qwen-Audio-3.0-TTS:支持自然语言直接控制,实时版首包延迟降至300毫秒

千问发布语音合成大模型Qwen-Audio-3.0-TTS:支持自然语言直接控制,实时版首包延迟降至300毫秒

文章介绍千问发布语音合成大模型Qwen-Audio-3.0-TTS,主打用自然语言直接控制语气、节奏与风格,降低语音生成门槛。同时推出实时交互的Flash版和高音质的Plus版,分别覆盖语音助手、实时问答及有声书、配音等场景。

2026-07-21 11:28
1
0

通义千问Qwen-Audio-3.0-TTS正式开放:首包延迟300ms 支持20种方言

通义千问Qwen-Audio-3.0-TTS正式开放:首包延迟300ms 支持20种方言

阿里通义千问发布Qwen-Audio-3.0-TTS,首包延迟仅300ms,支持Flash和Plus双版本。Plus版在Artificial Analysis Speech Arena全球第一,平均说话人相似度82.75;Plus版覆盖16种语言及20种中文方言,通过自然语言指令实现细粒度语音控制,支持高噪声鲁棒性与48K高清音频。已全面开放,助力实时语音交互与内容创作。

2026-07-20 17:28
934
0

推荐专栏

爱力方

爱力方

机器人前沿资讯及信息解读
机器人大讲堂

机器人大讲堂

中国顶尖的机器人专业媒体服务平台
关注爱力方,掌握前沿具身智能动态

© 2025 A³·爱力方

https://www.agentren.cn/