Audio
-
阿里发布语音合成大模型Qwen-Audio-3.0-TTS:Flash首包300ms级别,Plus登顶全球榜单
7月20日晚间消息,阿里巴巴发布语音合成大模型Qwen-Audio-3.0-TTS,在细粒度标签控制、freestyle指令遵循、多语种与方言覆盖以及复杂声学鲁棒性等方面系统性提升,包含面向实时交互的Flash版本(首包延时300ms级别)和面向高质量生成的Plus版本,让合成语音从“能说话”走向“会表达”。目前,在全球第三方权威榜单Artificial Analysis,Qwen-Audio-3.0-TTS-Plus斩获冠军。
-
阿里千问语音合成大模型Qwen-Audio-3.0-TTS发布,多语言方言支持且登顶权威榜单
阿里千问语音合成大模型Qwen-Audio-3.0-TTS发布,多语言方言支持且登顶权威榜单
-
阿里千问发布语音大模型Qwen-Audio-3.0-TTS,登顶AI榜单
阿里千问发布语音大模型Qwen-Audio-3.0-TTS,登顶AI榜单
-
字节发布音频创作模型Seed Audio 1.0
字节发布音频创作模型Seed Audio 1.0
-
字节跳动推音频创作模型Seed Audio,多数场景可用率超90%
字节跳动推音频创作模型Seed Audio,多数场景可用率超90%
-
字节跳动Seed Audio 1.0发布:多要素编排,音色稳定,多语种自然生成
字节跳动Seed Audio 1.0发布:多要素编排,音色稳定,多语种自然生成
-
字节跳动Seed Audio 1.0发布:多要素建模,多数场景音频可用率超九成
字节跳动Seed Audio 1.0发布:多要素建模,多数场景音频可用率超九成
-
阿里云发布Qwen-Audio-3.0-Realtime:毫秒响应,自主调用工具,对话更自然流畅
千问称,该模型在保持毫秒级时延响应的基础上,进一步增强了工具调用、多轮对话、情感表达和实时交互能力。该模型的研究团队将文本大模型的完整推理能力蒸馏至语音模型,同时通过多教师蒸馏策略确保该模型在口语、问答与推…
-
阿里云发布Qwen-Audio-3.0-Realtime:毫秒响应不掉智,自主调用工具更智能
阿里云发布Qwen-Audio-3.0-Realtime:毫秒响应不掉智,自主调用工具更智能
-
千问发布Qwen-Audio-3.0-Realtime:毫秒响应与深度推理兼得,多场景适用
千问发布Qwen-Audio-3.0-Realtime:毫秒响应与深度推理兼得,多场景适用
-
阿里Qwen-Audio-3.0-Realtime发布:双版本升级,多场景应用开启智能交互新体验
阿里Qwen-Audio-3.0-Realtime发布:双版本升级,多场景应用开启智能交互新体验
-
阿里Qwen-Audio-3.0-Realtime来袭:实时语音交互模型四线升级,又快又聪明!
阿里Qwen-Audio-3.0-Realtime来袭:实时语音交互模型四线升级,又快又聪明!
-
通义端到端语音交互模型Fun-Audio-Chat发布
通义端到端语音交互模型Fun-Audio-Chat发布
-
通义大模型再升级!Fun-Audio-Chat发布 开启语音交互实用化新篇章
通义大模型再升级!Fun-Audio-Chat发布 开启语音交互实用化新篇章
-
阿里通义新推Fun-Audio-Chat模型:端到端交互,懂情绪还能高效完成复杂任务
阿里通义新推Fun-Audio-Chat模型:端到端交互,懂情绪还能高效完成复杂任务


