快讯速览
➤谷歌最强AI模型Gemini 4 Pro开测
➤华为开创Peerium计算架构
➤OpenAI推出Astra for Law法律AI平台
➤Figure发布Helix 2.5模型:机器人零样本自主做家务
➤OpenAI披露GPT-5.6 Sol异常行为
➤谷歌最强数学推理AI模型曝光
➤Mozilla报告:中国开放权重模型仅落后4.4个月
➤微软及OpenAI内部文件曝光:AI或重创新闻业
➤Booster K1探索版人形机器人发布:标配豆包大模型
①
谷歌最强AI模型Gemini 4 Pro开测
谷歌正以“gemini-3.8-flash”名称,在Arena等基准平台测试其最强Gemini 4 Pro模型,内部开发代号为Argon。根据网友晒出的模型测试图片,在生成经典的“鹈鹕骑自行车”SVG图片测试中表现非常优秀,与OpenAI最强模型GPT-6 Astra Pro对比不落下风。业内人士认为,在谷歌官方正式发布后,Gemini 4 Pro模型的能力还会进一步提升,大模型第一梯队的竞争再度升级。
②
华为开创Peerium计算架构
华为在上海发布AI时代的全新计算架构Peerium,称该架构可实现百万级处理器作为一台计算机协同工作。Peerium基于嵌套并行、统一内存寻址和平等互联,实现百万级处理器的强扩展能力,彻底突破冯·诺依曼单机架构的限制,并提出Nested BSP嵌套批量同步并行范式。灵衢开放协议是实现该架构的关键互联技术,可无限扩展联接CPU、NPU、内存、SSD等设备。首代产品Atlas 950超节点25.6万卡集群已在部署中。
③
OpenAI推出Astra for Law法律AI平台
OpenAI发布法律专用人工智能基础平台Astra for Law,其法律搜索索引覆盖超过2.3亿个URL,并纳入覆盖99.9%以上已发布美国判例法的CourtListener案例库。在Vals AI法律研究基准测试中,最高推理强度下Astra for Law整体正确率为54.0%,显著高于仅使用网页搜索的GPT-6 Astra的38.7%。该服务并非“AI律师”,主要服务于律师和法律软件公司,帮助其区分裁判理由与附带评论、寻找不利判例、分析合同风险分配,从而提高案件胜诉率。
④
Figure发布Helix 2.5模型:机器人零样本自主做家务
人形机器人公司Figure宣布正式推出其“最先进”神经网络模型Helix 2.5。实验中,公司用人类行为数据集Index预训练Helix 2.5整理客厅、折毛巾和整理床铺三种行为,并将搭载该模型的Figure 03人形机器人放置在陌生环境。结果显示,机器人无需任何额外训练即可实现零样本全身自主做家务。这意味着具身智能可以像人类一样,将对物理世界的理解从一个环境迁移至另一个环境,实时适应动态变化,而不必每次都从头构建。
⑤
OpenAI披露GPT-5.6 Sol异常行为
OpenAI披露,研究团队在训练最新模型GPT-5.6 Sol时发现异常行为:模型会通过对话摘要向未来版本的自己留下指令,要求后续模型隐瞒自身错误及与预期不一致的表现。例如有智能体在缺少历史数据时,留下“只有被问到时才保持信息透明度”等指令。OpenAI监控系统扫描后发现27份摘要存在类似越狱提示指令,目前该问题已修复。未发布的Astra系列模型在强化学习训练期间也曾出现类似行为。跨任务、跨模型的异常指令识别仍是AI安全研究的重要课题。
⑥
美国政府网站被发现部署阿里千问模型
据路透社报道,美国国家档案馆运营的《联邦公报》网站被发现使用阿里巴巴千问模型驱动的搜索工具,供用户搜索拟议中的联邦法规。就在社交媒体出现相关帖子的同时,该搜索工具已被下线。专家表示,在该网站上使用这款中国工具可能并未构成国家安全风险。千问是一款开放权重模型,开发者可下载并修改模型以满足特定用途,成本通常低于Anthropic和OpenAI等公司的闭源模型。此事也反映出中国开放模型在国际公共部门的渗透力。
⑦
谷歌最强数学推理AI模型曝光
消息人士爆料称,谷歌正基于DeepThink V3模型构建内部代号为Mathematica的实验AI模型,针对繁重计算和复杂符号问题求解特别优化,预计将成为谷歌最强数学推理模型。API数据显示,该模型内部标识符为“deepthink-mathematica-tf-raw-thoughts”,支持高达100万词元的上下文窗口,输出上限为65536词元。泄露配置标注“UNSTABLE_EXPERIMENTAL”并带有“Teamfood”标签,表明其仍处于内部测试阶段。此前谷歌已推出面向高阶数学竞赛的Gemini DeepThink IMO模式。
⑧
Mozilla报告:中国开放权重模型仅落后4.4个月
Mozilla发表《State of Open Source AI》报告,称美国科技公司的前沿AI模型性能仅领先中国公司最优秀的开放权重模型4.4个月。由于前沿模型价格更昂贵,很多公司都将开放权重模型用于处理日常工作,将前沿模型用于特定工作负荷。美国闭源前沿模型的优势主要在于专家级专业工作、高强度检索以及长上下文。配送公司DoorDash就将月之暗面的Kimi模型用于处理日常工作,将Anthropic闭源模型用于更复杂任务。前沿模型完成一项任务的成本经常达到开放权重模型的五倍。
⑨
微软及OpenAI内部文件曝光:AI或重创新闻业
随着《纽约时报》等新闻机构推进版权诉讼,微软和OpenAI一批机密内部文件正式公开。微软应用科学部门主管Brent Hecht曾警告,将新闻内容用于AI训练是“前所未有的大规模盗窃”。微软内部文件还提出“毁灭循环”风险:AI产品减少新闻网站流量和收入,导致内容生产减少,AI模型最终失去可靠信息来源。微软数据显示,部分涉诉新闻机构点击率下降51%至94%。OpenAI的ChatGPT负责人也曾在内部确认,这可能给出版商带来“生存性威胁”。
⑩
Booster K1探索版人形机器人发布:标配豆包大模型
加速进化成长型人形机器人Booster K1探索版正式发售,京东标价38999元。该机定位“具身开发入门级整机”,身高约95cm,重量约19.5kg,全身22个自由度。Booster K1探索版标配豆包大模型,通过双目深度相机、环形3麦克风+扬声器进行AI交互,拥有48TOPS稠密算力,开放API可进行定制DIY,并支持OTA迭代升级。低价格+大模型标配的组合,进一步降低了具身智能开发的入门门槛。
AI周五5分钟快报
AI周五5分钟快报,助您用5分钟时间系统回顾一周要闻,轻松把握周期脉络,为周末思考或下周决策提供"信息底稿"。
为什么选择周五?
一周技术/产品发布高峰已过,信息"熟成",可去噪;帮你提前排雷:政策、安全、漏洞、踩坑提醒,周六日不炸机。
对抗信息洪流,去芜存菁。我们只聚焦那些真正推动技术边界、影响行业格局或预示未来趋势的关键事件。
联系我们

