Qwen-Audio-3.0 系列语音模型正式登陆千问 AI 平台。开发者现可通过 API 接口调用模型能力,或订阅 Token Plan 服务进行使用。
Qwen-Audio-3.0 系列模型概览
Qwen-Audio-3.0 是阿里巴巴推出的自研语音大模型系列,涵盖三大核心组件:语音识别大模型 Qwen-Audio-3.0-ASR、语音合成大模型 Qwen-Audio-3.0-TTS,以及实时语音交互对话模型 Qwen-Audio-3.0-Realtime。
在权威 AI 评测平台 Artificial Analysis 今年 7 月发布的榜单中,该系列模型在语音识别(ASR)、实时交互(RealTime)和语音合成(TTS)三大赛道均位列全球第一,实现“大满贯”。
核心功能与应用场景
- Qwen-Audio-3.0-ASR:专注语音转文字,支持复杂语境及专业领域的高精度识别。
- Qwen-Audio-3.0-TTS:实现文字转语音,支持多语种与多方言,可精准控制情绪、语气与节奏。
- Qwen-Audio-3.0-Realtime:提供端到端语音理解与对话能力,支持边听边说、随时打断追问及工具调用。
目前,该系列模型已广泛应用于千问 App、千问办公及 Qoder 等产品中。
千问 AI 平台生态升级
近期,千问 AI 平台密集上线多款主力模型,包括新一代基座大模型 Qwen3.8-Max、图像生成模型 Qwen-image 3.0 pro、全新一代视频生成模型 Wan3.0 以及 Kimi K3 等。平台现已覆盖文本、代码、语音、图像和视频全模态能力,为开发者提供一站式模型调用服务。
Token Plan 订阅服务优惠
个人版:
- Lite:39 元/月(每 7 天 2500 Credits)
- Standard:139 元/月(用量为 Lite 版的 4 倍)
- Pro:499 元/月(用量为 Lite 版的 16 倍)
团队版:
- 标准席位:50 元/席位/月(约 7.6 折)
- 高级席位:550 元/席位/月(约 7.9 折)
- 尊享席位:1398 元/席位/月
千问 AI 平台专为 Agent 打造,旨在驱动 AI 生产力发展。

