ITBear旗下自媒体矩阵:

阿里云Qwen-Audio-3.0语音模型重磅上线 三大功能赛道斩获全球榜首

   时间:2026-08-17 16:51:07 来源:互联网编辑:快讯 IP:北京 发表评论无障碍通道
 

阿里云近日正式推出Qwen-Audio-3.0系列语音模型,现已全面上线千问AI平台与阿里云百炼平台。开发者可通过API接口调用模型功能,或选择订阅Token计划获取服务,为语音技术应用提供多样化接入方式。

该系列包含三款自主研发的语音模型:语音识别大模型Qwen-Audio-3.0-ASR、语音合成大模型Qwen-Audio-3.0-TTS,以及实时语音交互对话模型Qwen-Audio-3.0-Realtime。在国际权威AI评测平台Artificial Analysis今年7月发布的语音领域榜单中,这三款模型分别在语音识别、实时交互和语音合成三个赛道斩获全球第一,技术实力获得国际认可。

Qwen-Audio-3.0-ASR模型具备复杂语境下的精准识别能力,可处理专业领域术语及多场景语音输入;Qwen-Audio-3.0-TTS模型支持多语种与方言合成,并能通过参数调节实现情绪、语气和节奏的灵活控制;Qwen-Audio-3.0-Realtime模型则突破传统交互模式,支持端到端语音理解与对话,实现边听边说、随时打断追问的流畅交互体验。

目前,该系列模型已在千问App、千问办公、Qoder等多款产品中落地应用,覆盖智能客服、内容创作、办公协作等多个场景。此次技术升级标志着阿里云在语音交互领域的技术积累进入新阶段,为行业开发者提供更高效的语音处理解决方案。

 
 
更多>同类资讯
全站最新
热门内容
网站首页  |  关于我们  |  联系方式  |  版权声明  |  争议稿件处理  |  English Version