语音
-
阿里发布语音合成大模型Qwen-Audio-3.0-TTS:Flash首包300ms级别,Plus登顶全球榜单
7月20日晚间消息,阿里巴巴发布语音合成大模型Qwen-Audio-3.0-TTS,在细粒度标签控制、freestyle指令遵循、多语种与方言覆盖以及复杂声学鲁棒性等方面系统性提升,包含面向实时交互的Flash版本(首包延时300ms级别)和面向高质量生成的Plus版本,让合成语音从“能说话”走向“会表达”。目前,在全球第三方权威榜单Artificial Analysis,Qwen-Audio-3.0-TTS-Plus斩获冠军。
-
阿里千问语音合成大模型Qwen-Audio-3.0-TTS发布,多语言方言支持且登顶权威榜单
阿里千问语音合成大模型Qwen-Audio-3.0-TTS发布,多语言方言支持且登顶权威榜单
-
阿里千问发布语音大模型Qwen-Audio-3.0-TTS,登顶AI榜单
阿里千问发布语音大模型Qwen-Audio-3.0-TTS,登顶AI榜单
-
阿里千问输入法正式上线:语音速录AI润色 无广告纯净输入新体验
阿里千问输入法正式上线:语音速录AI润色 无广告纯净输入新体验
-
阿里千问输入法App上线:语音秒变文稿,方言精准识别,无广告畅用无忧
阿里千问输入法App上线:语音秒变文稿,方言精准识别,无广告畅用无忧
-
阿里千问输入法正式上线:语音秒变文稿,方言识别无障碍,纯净无扰体验佳
阿里千问输入法正式上线:语音秒变文稿,方言识别无障碍,纯净无扰体验佳
-
阿里千问输入法正式上线!语音速记每分钟300字 无广告纯净输入新体验
阿里千问输入法正式上线!语音速记每分钟300字 无广告纯净输入新体验
-
谷歌Gemini语音自定义功能升级:四维调节让AI交流更贴合场景需求
谷歌Gemini语音自定义功能升级:四维调节让AI交流更贴合场景需求
-
谷歌测试Gemini语音自定义功能,新增速度、活力等四项调节选项
谷歌测试Gemini语音自定义功能,新增速度、活力等四项调节选项
-
苹果三星AI服务备案获通过 百度携手助力其拓展AI搜索与语音助手功能
苹果三星AI服务备案获通过 百度携手助力其拓展AI搜索与语音助手功能
-
OpenAI首款智能音箱曝光,将搭载GPT-Live语音模型
OpenAI首款智能音箱曝光,将搭载GPT-Live语音模型
-
阿里Qwen-Audio-3.0-Realtime来袭:实时语音交互模型四线升级,又快又聪明!
阿里Qwen-Audio-3.0-Realtime来袭:实时语音交互模型四线升级,又快又聪明!
-
豆包输入法鸿蒙版内测招募启动:语音识别加持 9键26键布局任选
豆包输入法鸿蒙版内测招募启动:语音识别加持 9键26键布局任选
-
特斯拉Grok与FSD深度融合:语音操控驾驶,AI生态迈向新阶段
特斯拉Grok与FSD深度融合:语音操控驾驶,AI生态迈向新阶段
-
特斯拉研发新突破:Grok语音操控FSD,让自动驾驶如专属司机般贴心
特斯拉研发新突破:Grok语音操控FSD,让自动驾驶如专属司机般贴心


