千问下调Qwen-Audio全线语音模型价格,ASR降幅达95%
9月23日,千问宣布下调Qwen-Audio全线语音模型价格,其中TTS降价约70%,Realtime降幅约85%,ASR降幅达95%,以降低用户使用成本。同日,千问还发布了Qwen-Audio-3.1系列语音大模型,覆盖语音识别、语音合成、实时语音交互及音频创作等能力。
Qwen-Audio-3.1-ASR为新一代语音识别大模型,支持30种语言和16种中文方言,新增原生转写润色能力,可去除语气词与重复表达,并支持分角色转写;Qwen-Audio-3.1-ASR-Next为基于下代架构的音频理解模型,可理解人物情绪、环境声与机械声,完成音频问答与推理。
Qwen-Audio-3.1-TTS支持多语种及方言合成,可实现同一音色跨语言自然迁移;Qwen-Audio-3.1-TTS-Next可围绕文本、时间戳和参考音频统一生成人声、音效和环境音,用于播客、有声书、影视及游戏等场景。
Qwen-Audio-3.1-Realtime支持全双工实时交互,可同时说和听,允许用户插话、打断,并能调用Agent工具完成任务。该模型正在与Qoder、千问办公等Agent,以及QwenNote、A2、Eva、千问AI眼镜等智能硬件结合。
官方表示,五款全新语音模型共同构成覆盖“理解-生成-交互-创作”的完整音频能力栈。
- 2026-09-23 15:15 | IT之家:阿里千问发布 Qwen-Audio-3.1 系列语音大模型,并下调全线产品价格阅读原文
IT之家 9 月 23 日消息,今天,千问正式发布 Qwen-Audio-3.1 系列语音大模型。本次升级不仅对语音识别、语音合成和实时语音交互三大核心模型进行了全面进化,更重磅推出了全新的音频创作模型 Qwen-Audio-3.1-TTS-Next 和音频理解模型 Qwen-Audio-3.1-ASR-Next。官方称,五款全新的语音模型同时推出,形成了一套覆盖“理解-生成-交互-创作”的完整音频能力栈。为进一步降低用户使用成本,Qwen-Audio 全线语音模型价格均下调,其中 TTS 降价约 70%,Realtime 降幅约 85%,ASR 降幅达 95%。IT之家附官方详细介绍如下:Q...