人工智能与机器人一周热点
一、行业动态
1.国务院:推进算力设施绿色转型,新建项目主要使用非化石能源电力
2.中国信通院启动智能体互联网关键系统技术验证工程
二、研究动态
3.Anthropic研究发现Claude内部出现类意识工作空间
4.谷歌登《Nature》:强化学习首次实现量子计算机实时校准,逻辑稳定性提升3.5倍
三、企业动态
5.SpaceXAI发布Grok 4.5:Opus级性能,成本较低
6.蚂蚁灵波发布空间感知模型Ling Bot-Depth 2.0
7.腾讯混元Hy3正式发布,Agent与产品体验升级
8.京东JoyAI上线UGC数字人功能:一张照片即可生成虚拟玩伴
9.生数科技发布Vidu S1,视频生成从离线剪辑迈向实时对话
10.英伟达联手Hugging Face,为LeRobot引入新模型与框架
11.阶跃星辰抢先官宣:全球首款AI智能体手机即将发布
12.苹果洽谈PrismML,拟将270亿参数大模型压缩部署至iPhone
13.千问大模型升级实时语音识别大模型Fun-ASR-Realtime
14.美团LongCat-2.0正式开源:国内首个国产算力全链路万亿参数大模型
15.1X发布25自由度仿生灵巧手,宣布年内量产万台
四、专家观点
16.OpenAI CTO穆拉蒂谈AI未来:并非命中注定,人机应同骑“双人自行车”
17.智源王仲远:世界模型是下一代AI基座,符合要求的模型尚未诞生
1.国务院:推进算力设施绿色转型,新建项目主要使用非化石能源电力
国务院印发《“十五五”碳达峰行动方案》,要求新建算力设施主要使用非化石能源电力,强化与可再生能源协同布局,支持绿电直供并配套储能,同时完善标准推动既有设施改造升级,鼓励建设零碳算力设施。这标志着算力基础设施低碳化正式纳入国家碳达峰顶层设计。
2. 中国信通院启动智能体互联网关键系统技术验证工程
3.Anthropic研究发现Claude内部出现类意识工作空间
Anthropic公司最新可解释性研究发现,其AI模型Claude内部神经网络中出现了类似意识机制的结构性特征——一个独立的信息汇聚与整合工作空间。研究通过“字典学习”方法识别出可跨任务泛化的特征节点,但团队强调这并非真正意识。该发现引发业内广泛争议,多位专家认为从特征识别到意识空间的推断尚需更多证据支撑。
4.谷歌登《Nature》:强化学习首次实现量子计算机实时校准,逻辑稳定性提升3.5倍
Google Quantum AI与DeepMind团队在《自然》杂志发文,首次将强化学习用于量子纠错的实时控制。实验表明,该框架将表面码逻辑稳定性提升3.5倍,创下7.72×10⁻⁴的逻辑错误率纪录,并有望扩展至数万参数规模。这标志着“永不停止计算”的量子计算机迈出关键一步。
5.SpaceXAI发布Grok 4.5:Opus级性能,成本较低
6.蚂蚁灵波发布空间感知模型Ling Bot-Depth 2.0
7.腾讯混元Hy3正式发布,Agent与产品体验升级
腾讯正式发布新一代基础模型混元Hy3,采用MoE架构。相比预览版,其在Agent任务、代码生成及推理能力上显著跃升,幻觉率下降超一半。Hy3已接入元宝、Work Buddy等产品,其中元宝上线Agent功能,可直接生成PPT、Word等文件,Work Buddy任务成功率升至90%。
8.京东JoyAI上线UGC数字人功能:一张照片即可生成虚拟玩伴
京东JoyAI App于2026年7月初上线UGC数字人功能,用户上传一张照片配合语音,即可快速生成专属数字分身,支持写实复刻与卡通风格重塑。该数字人依托"万能博士"技术底座,具备全双工对话能力,可随时打断、自然接话,实现类真人交流。在提供情绪陪伴的同时,还能无缝提供点外卖、金融咨询等生活服务,兼顾情感价值与实用价值。
9.生数科技发布Vidu S1,视频生成从离线剪辑迈向实时对话
生数科技在全球数字经济大会上正式发布面向实时交互场景的视频生成模型Vidu S1。该模型支持用户通过实时语音控制数字人行为,实现无限时长连续互动,打破了传统“输入提示词—等待生成—播放结果”的离线模式。Vidu S1采用自回归扩散架构,能以540P分辨率、25FPS帧率(最高42FPS)在消费级显卡上运行,用户上传单张图片即可快速创建专属交互角色。
10.英伟达联手Hugging Face,为LeRobot引入新模型与框架
英伟达宣布与Hugging Face深化合作,将面向人形机器人的开源视觉语言动作模型Isaac GR00T 1.7以及数据采集框架Isaac Teleop,集成至Hugging Face的开源机器人库LeRobot中。未来还计划接入Cosmos 3世界模型以支持仿真数据生成。
11.阶跃星辰抢先官宣:全球首款AI智能体手机即将发布
12.苹果洽谈PrismML,拟将270亿参数大模型压缩部署至iPhone
据The Information报道,苹果正与AI初创公司PrismML接洽,探讨将270亿参数大模型完整部署至iPhone本地运行的可能性。PrismML已成功将阿里开源模型Qwen 3.6从54GB压缩至不足4GB,在iPhone 17 Pro上无损运行,可完成复杂对话、推理及自主智能体任务。苹果端侧主力模型AFM 3 Core Advanced仅200亿参数且采用稀疏架构,若该技术落地,有望大幅提升端侧AI能力并减少云端依赖。
13.千问大模型升级实时语音识别大模型Fun-ASR-Realtime
千问大模型正式升级实时语音识别模型Fun-ASR-Realtime,首字延迟控制在百毫秒级别,识别准确率接近离线水平,且支持16种方言和30种语言。在影视飓风“重返荒岛”100小时直播中,该模型全程提供实时字幕,累计识别6万余条、132万字。其离线版Fun-ASR-Flash在Artificial Analysis评测中以1.7%字错率位列全球第一。
14.美团LongCat-2.0正式开源:国内首个国产算力全链路万亿参数大模型
美团正式开源万亿参数大模型LongCat-2.0,同步开放权重、推理引擎及核心技术文档。该模型总参数量达1.6万亿(MoE架构,激活约480亿参数),原生支持100万Token超长上下文。这是业界首个完全依靠国产算力完成训练与推理全流程的万亿参数模型,训练峰值规模超5万张国产算力卡。
15.1X发布25自由度仿生灵巧手,宣布年内量产万台
1X公司为人形机器人NEO打造了一款25自由度、腱绳驱动的仿生灵巧手,具备高精度力控与触觉感知,耐用性达IP68级。该手部已在产线运行,计划2026年内量产1万台。此举被视为人形机器人核心部件迈向万台级工程化的重要里程碑,但其AI自主性仍有提升空间,目前部分精细操作依赖预编程或远程操控。
16.OpenAI CTO穆拉蒂谈AI未来:并非命中注定,人机应同骑“双人自行车”
前OpenAI CTO、Thinking Machines Lab创始人穆拉蒂在彭博科技大会上表示,AI的未来“并非命中注定”,乌托邦或反乌托邦的预测都过于简化,人类仍有很大主动权。她主张AI应如“双人自行车”,人类与机器全程协作而非放手让系统自主狂奔。同时她呼吁AI治理不能依赖个人品格,需建立制度制衡、透明度和共享工具,避免决策权过度集中。
17.智源王仲远:世界模型是下一代AI基座,符合要求的模型尚未诞生
北京智源研究院院长王仲远在智源大会上指出,世界模型是下一代AI基座模型,核心是从“预测下一个词元”转向“预测下一个物理状态”,必须能感知时间空间、物理规律与常识,并具备主动交互能力,但符合这些要求的模型尚未诞生。他呼吁行业共建评测体系,预计未来三到五年持续迭代,突破依赖真实物理数据积累。

