TAG:TTS
Fish Audio 周年发布 S2.1 Pro 实时对话语音模型 支持耳语与情绪控制
Fish Audio周年重磅发布S2.1Pro实时对话语音大模型!支持耳语、情绪控制与短样本克隆,90毫秒低延迟,支持83种语言。鱼声音频API已上线,提供免费测试限额。开启语音AI新纪元,让对话更自然流畅。
通义千问Qwen-Audio-3.0-TTS正式开放:首包延迟300ms 支持20种方言
阿里通义千问发布Qwen-Audio-3.0-TTS,首包延迟仅300ms,支持Flash和Plus双版本。Plus版在Artificial Analysis Speech Arena全球第一,平均说话人相似度82.75;Plus版覆盖16种语言及20种中文方言,通过自然语言指令实现细粒度语音控制,支持高噪声鲁棒性与48K高清音频。已全面开放,助力实时语音交互与内容创作。
Resemble AI 开源旗舰 TTS 模型 防伪水印助力商业应用
Resemble AI开源旗舰级TTS模型Chatterbox Turbo,仅需5秒参考音频即可精准克隆语音,延迟低至150毫秒,性能超越闭源竞品。模型内置防伪水印功能,支持商业化应用,旨在重塑语音合成市场格局。
谷歌Gemini TTS 2.5发布:支持24种语言与情绪化语音
Google正式推出Gemini TTS 2.5文本转语音模型,主打情绪级表达、上下文自适应节奏及24语种多角色对话功能。新模型可一键切换音色与语速,适用于有声书、游戏NPC等场景,显著提升语音自然度与沉浸感。开发者现可免费测试,预计2025年第一季度投入生产环境。
阿里Qwen3-TTS发布:49种音色支持10语9方言,准确率超越主流商用模型
阿里巴巴推出Qwen3-TTS语音合成模型,支持49种音色、10种语言和9种方言,实现零样本多角色切换。该模型在WER基准测试中超越主流商用引擎,提供免费额度并已上线阿里云,适用于教育、客服、直播等场景。
美股三大指数震荡整理,芯片股走高,光通信板块大涨
2026-05-11
0 浏览
多空胶着恒指震荡整理,AI景气外溢主导行情波动
2026-05-11
0 浏览
宠物AI公司PurrPurr获阿尔法公社投资 首年GMV目标5000万
2026-05-11
0 浏览
隆源股份业绩说明会回应今年新能源汽车零部件领域新客户洽谈中
2026-05-11
0 浏览
中国品牌市占率达75%,4月我国汽车销量约252.6万辆,新能源汽车出口贡献度近五成
2026-05-11
0 浏览
4月汽车出口增长51% 国内零售下跌超20%
2026-05-11
0 浏览
4月全国新能源汽车渗透率历史首次突破60%,燃油车零售同比暴跌37%
2026-05-11
0 浏览
港股复盘:强势翻红 芯片概念股冲高回落 短期风险需警惕
2026-05-11
0 浏览
申昊科技拟设具身智能子公司 加码人形机器人业务
2026-05-11
0 浏览