← 資訊首页 | 货源大厅

千问Qwen-Audio-3.1发布:ASR降价95%

2026-09-23 · 来源:{'name': '36氪快讯·中继', 'url': 'https://www.36kr.com/newsflashes/3995657915273093'}

千问Qwen-Audio-3.1发布:ASR降价95%

千问五款语音模型齐发并全线降价,ASR降幅达95%。

千问推出新一代Qwen-Audio-3.1系列语音大模型,五款全新语音模型同时亮相,构成一套覆盖理解、生成、交互、创作全链路的音频能力栈。此轮更新把识别、合成、交互与创作等不同层级的能力整合进同一产品体系,开发者可以在一个模型家族内满足从听懂语音到生成音频的完整需求。

产品结构上,语音识别(ASR)、语音合成(TTS)与实时语音交互(Realtime)三大核心模型在此次升级中全面进化;千问同时新增两款模型,面向音频创作的Qwen-Audio-3.1-TTS-Next,以及面向音频理解的Qwen-Audio-3.1-ASR-Next,分别补上创作端与理解端的能力拼图。

定价是此次发布最受关注的变量。为进一步降低使用成本,Qwen-Audio全线语音模型价格同步下调:TTS降价约70%,Realtime降幅约85%,ASR降幅最大,达95%。以ASR为例,95%的降价意味着单位调用成本降至原先的约二十分之一,对以语音识别为主要负载的应用而言,成本结构被显著改写。

对模型采购方与应用开发团队而言,语音链路的调用费用是客服、实时交互、音频内容生产等高并发场景中的重要支出项。此轮调价后,ASR、Realtime等高频环节的单位成本大幅下移,语音类应用的规模化门槛随之降低;在同类语音大模型的选型比较中,这组新报价也提供了一个最新的成本参照。


萬安算交所 AIXX · 算力硬件实名会员制交易平台 · 进入货源大厅