大数跨境

AIIA周刊丨人工智能行业一周精选(9.12-9.18)

AIIA周刊丨人工智能行业一周精选(9.12-9.18) 人工智能产业发展联盟AIIA
2026-09-21
11
导读:金砖峰会提出人工智能开源普惠倡议,推动AI多边开放合作;阶跃星辰发布StepAudio3系列模型;生数科技发布Vidu S2视频大模型系列,探索VR实时空间视频生成;小米公开MiMo-V2.6大模型强

政策引导

1

金砖峰会提出人工智能开源普惠倡议,

推动AI多边开放合作

当地时间2026年9月13日上午,金砖国家领导人第十八次会晤第二阶段会议在印度新德里举行,中方提出人工智能开源普惠倡议,作为深化金砖合作五大倡议之一。根据倡议内容,我国将率先建设金砖国家人工智能开源专区,支持大语言模型开发和应用合作,组织开展人工智能专题研修培训,共同构建开放普惠的 AI 产业生态。该倡议立足金砖及广大全球南方国家发展需求,倡导 AI 技术开放共享,推动弥合各国人工智能发展鸿沟。对国内产业而言,将为我国大模型、开源数据集、AI 人才培养带来多边合作契机,有利于拓展 AI 国际协同与出海空间,引导产业在开源生态、技术培训、跨境应用层面开展务实布局。


链接

https://www.fmprc.gov.cn/web/zyxw/202609/t20260913_12021296.shtml


技术前沿

2

阶跃星辰发布StepAudio3系列模型,

五款产品同步上线

9月15日,阶跃星辰正式发布新一代语音大模型 StepAudio3 系列,一次性推出 StepAudio3 Realtime、StepAudio3 ASR、StepAudio3 TTS、StepAudio3 Gen、StepAudio3 Music 五款模型产品。该系列完整覆盖实时语音交互、语音识别、真人级语音合成、音频生成以及 AI 音乐创作场景。其中 StepAudio3 Realtime 具备原生全双工实时对话能力,可同时理解语义、语气、情绪以及环境音;StepAudio3 ASR 支持方言、中英混说,适配医疗、法律等专业业务场景;StepAudio3 TTS 支持超低时延流式生成,可还原笑声、迟疑等真人口语表现;StepAudio3 Gen 能够统一生成角色人声、音效与环境音;StepAudio3 Music 可实现歌曲创作、翻唱以及基于 ABC 记谱法的多轮音乐创作,标志国内语音 AI 技术从单点突破迈向全栈自研。


链接

https://platform.stepfun.com/docs/zh/guides/models/stepaudio-3-realtime

【短评】

StepAudio3系列补齐语音全链路产品矩阵,体现国内企业在语音大模型领域全栈研发能力持续提升。


3

Claude中小企业版完成重大更新,深度

对接主流商业工具

9月15日,Anthropic宣布对中小企业版Claude开展重大版本升级,推出43项预置高效工作流,新增Shopify、Salesforce、Zoom、Xero等27个主流商业软件深度集成,聚焦中小企业业务拓展、销售线索转化、日常管理报表等业务场景。本次更新包含多项实用能力,支持自动整合现金流、销售对比数据生成每周简报;可在非工作时段自动跟进业务咨询并录入CRM系统;支持依据语音备忘录生成正式报价提案。安全机制方面,全部自动化工作流默认开启人工审批,继承企业原有账户权限,Team与Enterprise版本默认不会使用用户商业数据训练模型。同时Anthropic同步启动秋季巡回培训计划,面向中小企业提供配套培训,降低企业使用门槛。


链接

https://claude.com/blog/claude-for-small-business-launches-new-workflows-integrations-and-training-programs

【短评】

Claude本次更新将AI能力嵌入企业财务、营销、客服业务流程,标志大模型产品进一步向垂直业务工作流落地。


4

生数科技发布Vidu S2视频大模型系列,

探索VR实时空间视频生成

9月15日,生数科技正式对外发布全新 Vidu S2 视频大模型系列,包含 Vidu S2‑Avatar、Vidu S2‑Editing 两款模型产品。Vidu S2‑Avatar 面向数字角色生成,用户上传一张图片,即可通过语音指令控制角色说话、跳舞,还可动态添加物品、更换背景。Vidu S2‑Editing 专注视频流实时编辑,支持风格迁移、虚拟试穿、人物替换、背景替换四大任务,画面可跟随人物动作自然变化。该系列还开展VR头显实时空间视频生成探索,能够将编辑完成的视频流式输出至VR头显设备。技术层面,模型采用 Self‑Replay Forcing(SRF)训练方法缓解身份漂移问题,引入VLM智能体作为视觉反馈,提升动作生成可靠性,实现 “边聊边改” 交互模式,降低视频创作操作门槛,发布当日同步开放在线体验。


链接

https://www.shengshu.com/zh/vidu-s2/

【短评】

Vidu S2视频大模型将AI视频生成能力推进至实时交互与流式编辑阶段,打通了AI视频模型与VR硬件的技术衔接路径。


5

豆包2.1 Pro 0915版本上线,面向企业

生产多项能力升级

9月16日,火山引擎宣布豆包大模型2.1 Pro完成0915版本升级,新版API正式在火山方舟上线,同时接入豆包工作产品,用户可直接切换新版本开展使用。本次更新聚焦企业实际生产工作场景,降低模型幻觉,强化证据溯源、时效判断与交叉数据核验,提升Agent复杂多任务处理可靠性。在金融投研场景下,模型可自主拆解研究需求,调度大量子Agent开展检索,引入多维度外部资料佐证,实现研究结论可溯源。多模态编程能力得到增强,能够梳理大型代码仓库跨文件依赖、定位修复Bug,支持将操作录屏、手绘草图转化为可运行代码。多模态理解能力同步迭代,支持长视频完整解析、跨帧提取关键信息,适配图纸解读、质量检测等专业场景。在运行效率上,图像与视频推理Token消耗量相比上一代下降30%以上,降低业务调用成本。


链接

https://baijiahao.baidu.com/s?id=1876645026101136214&wfr=spider&for=pc

【短评】

豆包大模型2.1 Pro 0915版本围绕企业生产需求迭代,在事实可靠性、多模态工程能力、推理成本三方面实现优化,进一步推进大模型向生产业务落地。


6

小米公开MiMo-V2.6大模型强化学习训练

进展

9月17日凌晨,小米MiMo大模型团队负责人罗福莉在X平台发文,首次公开 MiMo-V2.6大模型强化学习训练进展,同步上线实时训练页面,对大模型强化学习全流程进行公开直播,相关技术细节计划在未来数周内逐步开源。MiMo-V2.6正在开展大规模多任务智能体强化学习实验,从算力、环境、评估三维度拓展:算力实现单步约20 亿 Token完全异步并行;环境搭建支持混合多框架的代理式 RL;评估采用带测试用例与量规奖励的组内信用分配机制。实时页面展示训练成本指标,MiMo-V2.6-Pro 训练时长1天19小时,耗资89万美元;MiMo-V2.6-Flash 训练时长1天14小时,耗资39.7万美元,双版本累计训练成本突破128万美元。罗福莉为小米引进的AI科研人才,此前主导DeepSeek-V2研发,其带领的团队今年3月推出的Mimo-V2-Pro曾位列Artificial Analysis全球大模型综合智能榜第八位。


链接

https://baijiahao.baidu.com/s?id=1876564365820584785&wfr=spider&for=pc

【短评】

小米公开大模型强化学习全流程与训练成本数据,以透明化方式展示智能体 RL 技术迭代,后续开源将为行业提供参考。


7

千问Qwen3.8-Omni-Flash发布,音视频

处理成本大幅下调

9月18日,阿里千问正式上线新一代原生全模态模型Qwen3.8-Omni-Flash,已在千问AI平台开放使用。模型支持文本、图像、音频、视频多类型输入,上下文窗口达1M Token。对比上一代Qwen3.5-Omni-Plus,该模型在30项评测平均得分提升超26%;音视频Agent、编码、长程任务等基准测试均取得明显进步,会议场景最长支持一小时音视频输入,可完成说话人区分、转录、纪要生成、风险分析及工具调用。API定价大幅下调,每小时音频输入价格降幅超98%,每小时音视频输入价格降幅超93%。同步推出实时版本Qwen3.8-Omni-Flash-Realtime,为首个支持 “听声辨位” 的全模态大模型,可融合空间声音与视觉判断声源方位。本次还开源Qwen-Live Harness,发布Qwen-MM-Plugins,支撑长音视频Agent工作流与实时全模态交互。


链接

https://baijiahao.baidu.com/s?id=1876639054345758872&wfr=spider&for=pc

【短评】

新版全模态模型Qwen3.8-Omni-Flash在音视频理解、Agent能力、调用成本上实现显著优化,实时空间音频感知能力拓展了全模态大模型的应用边界。


产业热点

8

地瓜机器人完成4亿美元C轮融资,发力

具身智能机器人通用底座

9月17日,地瓜机器人宣布完成4亿美元C轮融资,距离B轮投资仅5个月,2026年内累计融资额已超过6亿美元。本轮由未来资产领投,美团战略投资部参与,合肥国投、南山战新投、璟泉资本等国资平台,以及多家一线投资机构联合跟投,过半老股东持续追加投资。地瓜机器人由地平线孵化、2024年初分拆独立,专注提供机器人软硬一体底层开发底座,核心产品包含旭日系列智能计算芯片、RDK机器人开发者套件。本轮资金将重点投入芯片产品布局与端云一体全链路软件平台研发。


链接

https://baijiahao.baidu.com/s?id=1876589350569205033&wfr=spider&for=pc


【短评】

大额C轮融资体现资本对具身智能底层基础设施赛道的看好,地瓜机器人依托RDK开发者生态,降低机器人开发门槛,加速具身智能技术落地。


9

奕行智能完成近20亿元新一轮融资,投后

估值接近150亿元

9月18日,RISC-V云端AI算力芯片企业奕行智能完成新一轮融资,融资金额近20亿元,据估计其投后估值接近150亿元。本轮投资方包括华泰创新、钟鼎资本、九安医疗、仁爱资本、赛意产业基金、和利资本、芯鑫租赁、恒旭资本、尚颀资本、容亿资本等20余家投资机构。奕行智能成立于2022年,专注于全栈自研的RISC-V AI计算芯片及计算平台解决方案,采用基于RISC-V指令集及其向量扩展(RVV,Vector Extension)、类TPU AI推理与训练架构和自研VISA虚拟指令集融合的差异化技术路线。本轮融资将支撑其 RISC-V AI 芯片技术迭代与产品落地,助力大模型、具身智能等产业的算力供给建设。


链接

https://baijiahao.baidu.com/s?id=1876635235900217836&wfr=spider&for=pc

【短评】

本轮大额融资体现资本看好 RISC-V 路线云端 AI 算力芯片赛道,国产自主指令集算力方案将为大模型、具身智能提供底层算力支撑。


观点言论

10

济南举办AI安全治理论坛,王京涛

提出三点建议

9月15日,2026年国家网络安全宣传周人工智能安全治理论坛在山东济南召开,论坛主题为“智能之治 向上向善”。中央网信办副主任王京涛出席并致辞,强调AI发展要坚守“以人为本、向上向善”价值导向,推动人工智能安全、可靠、可控发展,并提出三点建议:坚持包容审慎、敏捷治理,完善AI安全监管制度;坚持问题导向、风险导向,夯实人工智能内生安全根基;坚持联防联控、共治共享,协同共建人工智能安全治理格局。本次论坛聚焦智能体风险防控、全周期安全治理等议题,会上发布“人工智能应用安全指引”系列网络安全标准实践指南、大模型安全众测结果等多项成果,汇聚政产学研用各方力量共商AI安全治理路径。


链接

https://wlaq.gmw.cn/2026-09/16/content_39003683.htm

【短评】

论坛释放出我国人工智能 “创新发展与安全治理并行推进” 明确导向,敏捷监管、内生安全、多方协同成为 AI 治理核心抓手。


本周刊由AI助手自动生成,谨供参考

审核人:中国信通院人工智能研究所 赵逸飞


【声明】内容源于网络
0
0
人工智能产业发展联盟AIIA
中国人工智能产业发展联盟(简称AIIA)是在国家发改委、科技部、工信部、网信办指导下,由中国信息通信研究院等单位发起的行业组织,立足于搭建全球化的人工智能生态合作平台,支撑政府决策,推进技术创新与应用落地,促进我国人工智能产业有序发展。
内容 261
粉丝 0
人工智能产业发展联盟AIIA 中国人工智能产业发展联盟(简称AIIA)是在国家发改委、科技部、工信部、网信办指导下,由中国信息通信研究院等单位发起的行业组织,立足于搭建全球化的人工智能生态合作平台,支撑政府决策,推进技术创新与应用落地,促进我国人工智能产业有序发展。
总阅读17.2k
粉丝0
内容261