9月23日 ,阿里发布Qwen-Audio-3.1系列语音大模型,语音转写(ASR) 、语音合成(TTS)和实时语音交互(Realtime)三类模型全面升级,API(应用程序编程接口)服务均已上架千问AI平台 。同时 ,为进一步降低用户使用成本,Qwen-Audio全线语音模型费用 均下调,比较高 降幅95%。具体在语音转写方面,Qwen-Audio-3.1-ASR增强了多语种、方言识别与上下文理解能力 ,新增原生转写润色能力,可自动去除语气词与重复表达并重组语义。语音实时交互方面,Qwen-Audio-3.1-Realtime可以主动调用Agent工具完成任务 。

(文章来源:北京商报)