TAG:TTS

Fish Audio 周年发布 S2.1 Pro 实时对话语音模型 支持耳语与情绪控制

Fish Audio 周年发布 S2.1 Pro 实时对话语音模型 支持耳语与情绪控制

Fish Audio周年重磅发布S2.1Pro实时对话语音大模型!支持耳语、情绪控制与短样本克隆,90毫秒低延迟,支持83种语言。鱼声音频API已上线,提供免费测试限额。开启语音AI新纪元,让对话更自然流畅。

2026-07-29 15:18
10
0

通义千问Qwen-Audio-3.0-TTS正式开放:首包延迟300ms 支持20种方言

通义千问Qwen-Audio-3.0-TTS正式开放:首包延迟300ms 支持20种方言

阿里通义千问发布Qwen-Audio-3.0-TTS,首包延迟仅300ms,支持Flash和Plus双版本。Plus版在Artificial Analysis Speech Arena全球第一,平均说话人相似度82.75;Plus版覆盖16种语言及20种中文方言,通过自然语言指令实现细粒度语音控制,支持高噪声鲁棒性与48K高清音频。已全面开放,助力实时语音交互与内容创作。

2026-07-20 17:28
934
0

Resemble AI 开源旗舰 TTS 模型 防伪水印助力商业应用

Resemble AI 开源旗舰 TTS 模型 防伪水印助力商业应用

Resemble AI开源旗舰级TTS模型Chatterbox Turbo,仅需5秒参考音频即可精准克隆语音,延迟低至150毫秒,性能超越闭源竞品。模型内置防伪水印功能,支持商业化应用,旨在重塑语音合成市场格局。

2025-12-29 10:16
3
0

谷歌Gemini TTS 2.5发布:支持24种语言与情绪化语音

谷歌Gemini TTS 2.5发布:支持24种语言与情绪化语音

Google正式推出Gemini TTS 2.5文本转语音模型,主打情绪级表达、上下文自适应节奏及24语种多角色对话功能。新模型可一键切换音色与语速,适用于有声书、游戏NPC等场景,显著提升语音自然度与沉浸感。开发者现可免费测试,预计2025年第一季度投入生产环境。

2025-12-11 15:51
97
0

阿里Qwen3-TTS发布:49种音色支持10语9方言,准确率超越主流商用模型

阿里Qwen3-TTS发布:49种音色支持10语9方言,准确率超越主流商用模型

阿里巴巴推出Qwen3-TTS语音合成模型,支持49种音色、10种语言和9种方言,实现零样本多角色切换。该模型在WER基准测试中超越主流商用引擎,提供免费额度并已上线阿里云,适用于教育、客服、直播等场景。

2025-12-08 15:00
27
0

推荐专栏

爱力方

爱力方

机器人前沿资讯及信息解读
机器人大讲堂

机器人大讲堂

中国顶尖的机器人专业媒体服务平台
关注爱力方,掌握前沿具身智能动态

© 2025 A³·爱力方

https://www.agentren.cn/