云起钱塘,声入千行。
一年一度,再会云栖。今年,我们将携语音识别、语音生成与实时交互领域的最新进展而来,与一路关注 Qwen Audio 的朋友们重聚云栖,共同探索声音与智能交汇的更多可能。
9 月 22 日至 24 日,2026 云栖大会将在杭州国际博览中心举行。9 月 23 日下午,我们将在「千问语音大模型:重塑交互入口,释放声音生产力」分论坛上,与行业伙伴围绕技术演进、产品实践与产业落地展开交流。大会期间,千问语音大模型展位也将亮相国际博览中心二期,集中展示多项最新模型能力与产品成果。
#Part 1 千问语音大模型分论坛
9月23日 13:30-16:15
地点
杭州国际博览中心一期 1F 102B 宴会厅
结合 CosyVoice Studio 产品探索,以及语音 AI 与 Agent、智能硬件的融合实践,论坛还将邀请来自知识服务、游戏、媒体企业服务和智能汽车等领域的行业伙伴分享落地经验,共同探讨语音 AI 如何回应真实需求、创造实际价值。
主题 1 语音 AI 技术进展
Qwen-Audio-3.1:重塑交互入口,释放声音生产力
李先刚 阿里巴巴 ATH 事业群 - Token Foundry Qwen Audio 负责人
Qwen-Audio-3.1-ASR:从转写到理解的语音智能
高志付 阿里巴巴 ATH 事业群 - Token Foundry Qwen Audio 算法科学家
Qwen-Audio-3.1-TTS:从真实语音表达到全声景生成
赵瀚 阿里巴巴 ATH 事业群 - Token Foundry Qwen Audio 算法科学家
Qwen-Audio-3.1-Realtime:全双工实时语音交互技术与开源实践
邓憧 阿里巴巴 ATH 事业群 - Token Foundry Qwen Audio 算法科学家
主题 2 语音 AI 应用实践
语音大模型行业演进与商业实践
羽衣 阿里巴巴 ATH 事业群 - Token Foundry Qwen Audio 产品负责人
颗粒归仓,向前一步:得到大脑 526 升级背后的思考
杨超 北京思维造物信息科技股份有限公司 - 得到大脑产品负责人
AI 语音在游戏场景的应用实践:从内容到交互到创造
陈志鹏 杭州网易雷火科技有限公司 - 网易雷火伏羲语音算法负责人
智能音频在媒体客户端的全场景交互创新
张深源 人民日报社新媒体中心 - 产品总监
大模型时代的座舱语音新范式
吴伟坚 广州汽车集团股份有限公司 - 广汽集团座舱产品线主任工程师
从语音 Agent 到业务效果引擎:容联云端到端语音大模型的多行业落地实践
彭波 北京容联易通信息技术有限公司 - 容联云 AI 产品负责人
#Part 2 语音模型互动展区
时间
9月22日-9月24日
地点
杭州国际博览中心二期 1F 馆,杭州市萧山区奔竞大道 353 号
展位
基础大模型-千问语音大模型——1-B1-5
论坛之外,Qwen Audio 还将带来 Qwen-Audio-3.1-ASR、Qwen-Audio-3.1-TTS、Qwen-Audio-3.1-TTS-Next、Qwen-Audio-3.1-Realtime 和 CosyVoice Studio 等模型体验与落地产品的现场展示。
提前剧透一个首次亮相的新模型——Qwen-Audio-3.1-TTS-Next 。它将呈现 Qwen Audio 从语音生成迈向通用音频生成的最新进展:根据一段脚本生成包含语音及完整环境声场的音频,并支持细粒度时间戳控制、声音复刻和 48 kHz 输出,满足有声书、影视剧和播客等专业创作需求。
从听清、听懂,到自然表达、实时交互与多元音频创作,欢迎来到现场,近距离体验 Qwen Audio 的最新模型与产品能力。
从论坛里的分享,到展区里的交流,我们期待和老朋友重逢,也认识更多关注阿里语音 AI 的新朋友。这个九月,相聚云栖,一起探索声音生产力,让“智以致用”走进更多创作与工作场景。
👇点击文末「阅读原文」申领大会门票,9 月云栖见!


