技术动态
01
爱诗科技:发布通用实时世界模型 PixVerse R2
9月23日,爱诗科技(AIsphere)正式发布具备Scaling能力的通用实时世界模型PixVerse R2,并向用户开放包括游戏、互动影视及数字人等多个场景体验间。
PixVerse R2采用自研的Omni Causal AR与Real-Time Acceleration双层架构,实现了视频生成从“内容生产工具”向“生成式环境”的跨越。该模型支持用户实时探索、互动和剧情改写,广泛应用于游戏、互动影视及数字人等领域,其核心技术突破在于将“能力提升”和“实时运行”拆分为独立层次,解决了高维信号难以扩展的行业难题。
技术报告:
https://pixverse.ai/zh/blog/pixverse-r2-scaling-real-time-omni-world-models?sessionid=
原文链接>> 爱诗科技PixVerse R2 破解Scaling难题
02
小米:发布并开源 Xiaomi MiMo-V2.6
9月22日,小米正式发布并开源 Xiaomi MiMo-V2.6,包含Pro和Flash两个原生全模态模型,Pro版拥有1.02万亿参数,支持1M超长上下文处理能力。
Xiaomi MiMo-V2.6核心突破在于通过大规模强化学习(RL)扩展,单次训练可处理2.5万条任务轨迹,覆盖编程、视觉设计、网络安全等复杂任务。该模型创新性地采用分组智能体评分机制(GRS/GAR),能精细区分不同解决方案的优劣,并通过冻结专家路由参数等技术,将奖励作弊率控制在2%以下。
开源链接:
https://huggingface.co/collections/XiaomiMiMo/mimo-v26
原文链接>> Xiaomi MiMo-V2.6:扩展强化学习规模,迈向自我提升
03
理想:发布世界动作触觉模型 ME-Dex-1.0
9月21日,理想Foundation Model团队正式发布世界动作触觉模型ME-Dex-1.0(MachEmbodied-Dex-1.0)。
ME-Dex-1.0通过三专家架构(视觉、触觉、动作)和34区域统一模板,实现接触力预判与跨模态协同,显著提升机器人操作精度。将触觉信号从辅助条件升级为可预测的未来状态,为精密装配等工业场景提供了新解决方案。
arXiv论文:
https://arxiv.org/pdf/2609.21449
技术博客:
https://machembodied.com/ME-Dex/ME-Dex1.0.html#model
GitHub:
https://github.com/MachEmbodied/ME-Dex-1.0
原文链接>> 理想世界模型交卷:可以预测触觉
04
阿里千问:开源图像模型 Qwen-Image-2.1
9月20日,千问开源Qwen-Image-2.1,一个兼顾生成效果、推理效率与使用成本的图像模型。
Qwen-Image-2.1采用轻量简洁的模型结构,将文生图与图像编辑整合在同一模型中,视觉生成部分包含32层Single-Stream DiT,参数量为7B,并原生支持透明图像的生成与编辑。图像编辑能力的提升,主要体现在4个方面:支持多图编辑、能够实现多种局部编辑方式、人像与商品一致性增强,并覆盖多种类型编辑任务。
GitHub:
https://github.com/QwenLM/Qwen-Image-2.1
Model Scope:
https://www.modelscope.cn/models/Qwen/Qwen-Image-2.1
Hugging Face:
https://huggingface.co/Qwen/Qwen-Image-2.1
原文链接>> Qwen-Image-2.1开源:轻量高能,创作编辑一体化
05
腾讯微信:开源知识管理框架 WeKnora
近日,微信AI团队开源基于大语言模型的知识管理框架WeKnora,围绕RAG快速问答,ReAct Agent智能推理和Wiki模式构建,希望将分散的文档沉淀为可查询、可推理、可持续演进的知识资产。
WeKnora支持PDF、Word、图片等多种格式的深度解析,通过RAG(检索增强生成)技术实现智能问答,并具备知识图谱构建、多平台协作等功能。WeKnora采用模块化架构,可私有化部署,确保数据安全,适用于构建内部知识库、智能客服等场景。
项目地址:
https://github.com/Tencent/WeKnora
官网地址:
https://weknora.weixin.qq.com
原文链接>> 微信AI团队开源WeKnora
06
稀宇科技:正式开源 MiniMax Code CLI
近日,MiniMax Code CLI 面向全球开发者正式开放,并且以MIT协议正式开放源代码,支持Windows、macOS和Linux系统。
MiniMax Code CLI 作为MiniMax Code客户端的核心组件,提供交互式终端界面(TUI)、无界面自动化(Headless)和编辑器协议(ACP)三种运行模式,集成了代码编辑、命令执行、测试验证等功能。该工具支持自带密钥(BYOK)接入第三方模型,兼容OpenAI和Anthropic API格式,并内置多层安全防护机制。
Github:
https://github.com/MiniMax-AI/minimax-code
原文链接>> MiniMax Code CLI 正式开源
行业动态
07
阿里千问:发布Qwen-Audio-3.1系列语音大模型
9月23日,千问正式发布Qwen-Audio-3.1系列语音大模型,包含语音识别(ASR)、语音合成(TTS)和实时语音交互(Realtime)三大核心模型与全新的音频创作模型 Qwen-Audio-3.1-TTS-Next 和音频理解模型 Qwen-Audio-3.1-ASR-Next。
该系列支持30种语言和16种中文方言,具备流式识别、分角色转写、情绪识别等能力,其中ASR-Next能理解环境声和机械声,TTS-Next可一次生成人声、音效和环境音。五款全新的语音模型同时推出,形成了一套覆盖“理解-生成-交互-创作”的完整音频能力栈。
原文链接>> Qwen-Audio-3.1:能听懂、能创作、能聊天
08
腾讯:WorkBuddy企业版办公套件化升级
9月23日,腾讯WorkBuddy企业版做了办公套件化升级。
腾讯文档、腾讯乐享、腾讯网盘、安全与效能运营平台、腾讯AI设计智能体Ardot首批接入,对于企业来说,可以实现“三个一”:一个订阅、一个Agent底座、一个管理后台——不需要再为产品的AI功能独立付费,管理员可以在一个入口管理所有产品的Credit用量,还能让各端AI读写同一份办公记忆和数据,优化Agent交付与产出质量,助力企业AI原生的办公体验再升级、企业生产力再提效。
原文链接>> WorkBuddy 企业版办公套件化升级
09
腾讯混元:发布 Hy Image3.5 preview
9月22日,腾讯混元正式发布混元图像3.5预览版(Hy Image3.5 preview)。
Hy Image3.5 preview 模型支持文生图和图生图,单次最多可上传5张图作为参考,并支持多种尺寸比例输出,能实现最高2K分辨率输出,模型支持多轮对话创作,可基于历史上下文进行连续创作和编辑。通过与元宝、WorkRally、OnSolo、Miora、WorkBuddy、ima等产品深度协同,大幅提升面向生活、学习和生产力等场景的效果与能力。
原文链接>> Hy Image3.5 preview 发布
10
阿里平头哥:推出AI芯片 真武V900
9月22日,在2026杭州云栖大会上,阿里平头哥推出AI芯片真武V900,算力提升至真武M890的3倍。
真武V900通过自研ICN Switch互联技术实现千卡级超节点组网,显存达216GB,片间互联达到1200GB/s,原生支持FP8/FP4低精度计算,单集群可扩展至50万卡规模,已支撑超2万亿参数模型推理,计划2027年Q1量产。
原文链接>> 阿里推新款真武AI芯片
11
海光信息:发布1000系列CPU
9月22日,海光信息在深圳举办“释放端侧算力 驱动物理世界”新品发布会,正式发布1000系列CPU,这是海光面向工业控制等物理世界场景的芯片。
海光1000系列CPU采用自研C86架构,4核8线程设计,典型功耗仅10W,支持-40℃至105℃宽温运行。该芯片集成iGPU,具备4K60双路显示能力,兼容DDR4/DDR5内存,覆盖工控、轨交、医疗等场景,核心优势在于工业级可靠性(如ECC内存纠错、10年供货承诺)和国产化安全(国密算法、硬件加密)。
原文链接>> 全新CPU,来了!
12
月之暗面:推出 Kimi Code Desktop
9月21日,月之暗面推出Kimi Code Desktop,macOS 和 Windows 版同步上线。
作为Kimi Code官方桌面客户端,它将Kimi Code智能编程服务能力带到桌面应用中。不仅可以在桌面端内直接使用Kimi Code的AI Agent能力,通过对话让它读写代码、运行命令、完成自动化任务,还能在全新可视化的图形交互界面中,集中管理所有项目,调整常用配置,清晰查看Agent执行任务的每一步。
原文链接>> Kimi Code Desktop 正式与你见面
13
阶跃星辰:发布旗舰模型 Step 5 Preview
9月20日,阶跃星辰发布旗舰模型Step 5 Preview,是一款面向真实世界 Agentic 任务的旗舰基座模型。
Step 5 Preview采用稀疏MoE架构,总参数量600B、激活参数仅27B,支持100万Token上下文窗口,原生支持文本与视觉输入,在AI编程、软件工程、专业知识工作、金融等场景表现突出。
原文链接>> 阶跃发布旗舰模型 Step 5 Preview
政策趋势
14
江苏:印发《江苏省促进词元经济高质量发展行动方案(2026年)》
9月20日,江苏省发展改革委、江苏省数据局印发《江苏省促进词元经济高质量发展行动方案(2026年)》,共提出26项措施。
《方案》将“词元”定位为AI处理信息的最小单元,具有可计量、可定价、可交易三大特征,相当于智能时代的“价值锚点”。核心举措包括建设2000个高质量数据集、新增50款备案大模型、打造100个行业智能体,并首次在省级层面推出“词元券”补贴政策,支持企业购买算力服务。方案还创新提出词元工厂、词元超市等零售化业态,并探索词元计量标准和跨境交易机制。
原文链接>> https://fzggw.jiangsu.gov.cn/art/2026/9/20/art_51012_11832454.html
15
浙江:发布《关于加快“人工智能+消费”发展的若干措施》
9月20日,2026浙江省新消费创新大赛资源对接会在杭州启动。会上,浙江省商务厅联合24个省级部门发布《关于加快“人工智能+消费”发展的若干措施》。
《措施》明确,通过推动“人工智能+商品消费”扩容升级,促进“人工智能+服务消费”提质惠民,拓展“人工智能+消费”平台场景,加强“人工智能+消费”要素和制度保障四项重点工作。《措施》提出,到2030年,浙江将培育一批消费领域具有全球竞争力和影响力的人工智能企业,建设一批“人工智能+消费”集聚区,推动全省消费领域规模以上人工智能核心产业营业收入超6000亿元。
原文链接>> https://local.cctv.com/2026/09/21/ARTIJIiJrH4MatOkfxWRLwTt260921.shtml
声明:资料素材均来源官方媒体/网络,如有侵权,请联系删除。
✦
✦
END
南京新一代人工智能研究院
Nanjing Research
Institute of Next-generation Artificial Intelligence
南京新一代人工智能研究院,是中国信息通信研究院在人工智能、大数据领域投资组建的控股企业,是江苏省人工智能产业公共技术服务平台的落地运营单位。
研究院以“服务国家战略实施,促进地方产业升级”为导向,在人工智能和大数据领域,开展前沿技术研究、标准制定、评测工具开发、实验能力建设等工作,可为企业提供全方位的诊断、咨询、培训、评估服务。
联系方式
吴老师 17788386765(微信同号)
杨老师 15221125491(微信同号)

