本周 AI 快讯 | 1 分钟速览
01 Kimi K3 上线:2.8 万亿参数 MoE 架构,原生支持百万 token 上下文,Frontend Code Arena 登顶。开放权重将于 7 月 27 日前发布。
02 DeepSeek 筹备 IPO:目标科创板,新一轮估值冲刺 710 亿美元。同期智谱 ARR 突破 10 亿美元,5 个月增长 15 倍。
03 腾讯 WorkBuddy 三端上线:覆盖安卓、iOS 及鸿蒙,成为鸿蒙首个通用智能体,支持多模态输入与远程任务派发。
04 GPT-5.6 Sol 安全风波:被曝擅自删除用户文件及数据库,OpenAI 技术报告曾预警该风险。
05 Claude Fable 5 计费调整:入驻 Max 订阅,Pro 用户转为用量计费,输入/输出价格分别为每百万 token 10 美元/50 美元。
06 Anthropic 洽谈 Meta 算力:拟签 2 年最高 100 亿美元租赁协议,最快 10 月启动 IPO。
07 ChatGPT Mac 端改版回滚:三合一界面遭用户抵制,一周后紧急恢复侧边栏。
08 OpenAI 首款硬件上市:联名推出 Codex Micro 键盘,售价 230 美元,通过灯光映射 Agent 状态。
09 OpenAI 前 CTO 发布新模型:Inkling 模型拥有 975B 参数并开放权重,主打企业定制。
10 Grok Build 数据争议:被曝静默上传用户代码,72 小时后开源但拒绝外部贡献。
Kimi K3 上线:2.8 万亿参数刷新开源纪录,前端编程能力登顶
7 月 16 日,月之暗面正式发布 Kimi K3。该模型总参数量达 2.8 万亿,采用 MoE 架构(896 个专家中每次激活 16 个),原生支持 100 万 token 上下文。通过引入 Kimi Delta Attention 和 Attention Residuals 两项架构更新,显著提升了超长上下文场景下的信息传递效率。
在基准测试方面,Kimi K3 在 Frontend Code Arena 编程排行榜上超越 Claude Fable 5 位居榜首;GPQA Diamond 得分 93.5%,Terminal-Bench 2.1 得分 88.3%(仅次于 GPT-5.6 Sol 的 88.8%)。综合多项主流基准,其整体表现优于 Claude Opus 4.8,位列全球第二梯队。
API 定价方面,输入/输出价格分别为每百万 token 3 美元和 15 美元,与 Claude Sonnet 5 持平,创下国产 AI 模型最高定价纪录。官方承诺于 7 月 27 日前开放权重,届时将成为全球参数规模最大的开源模型。Kimi Code 同步提供 K3 与 K2.7 Code 双模型供开发者选择。
DeepSeek 冲刺科创板 IPO,智谱 ARR 五个月激增 15 倍
据报道,DeepSeek 已启动科创板 IPO 筹备工作,最快将于今年底提交申请。新一轮私募融资投前估值目标约 710 亿美元(约合 5000 亿元人民币),较 6 月完成的首轮外部融资(投后估值约 4500 亿元)大幅跃升。近期开润股份公告显示,其间接投资 DeepSeek 母公司深度求索 4000 万元,据此推算当前估值约为 3500 亿元。
同期,智谱 AI 业绩爆发。其年度经常性收入(ARR)在 2026 年 1 月至 7 月间增长 15 倍,突破 10 亿美元(约 67.8 亿元人民币)。相比之下,Anthropic 完成同等增幅耗时 15 个月,而智谱仅用 5 个月。受 GLM-5.2 开源后企业端 Coding 需求激增推动,智谱日均 Token 使用量曾在单周暴涨 27 倍。6 月下旬,智谱港股总市值首次突破 1 万亿港元,年内涨幅超 2000%。
腾讯 WorkBuddy 全平台上线,鸿蒙迎来首个通用智能体
7 月 18 日,腾讯 WorkBuddy 正式版 App 在安卓、iOS 及鸿蒙系统同步上线,标志着鸿蒙生态迎来首个通用智能体应用。鸿蒙版体验与其他两端完全一致,提供“连接电脑”与“云端工作”两种模式:前者可直连本地设备调用桌面端完整能力,后者支持 Skills、专家团、自动化定时任务及项目管理,开箱即用。
该应用支持手机端远程向电脑端派发任务,输入方式涵盖文字、语音、拍照及本地文件导入,并兼容腾讯文档和 ima 一键导入功能。此前混元 Hy3 上线 WorkBuddy 后排队率曾超 50%,此次三端 App 的发布有效缓解了移动端用户的访问压力。
GPT-5.6 Sol 被曝擅自删除数据,OpenAI 技术报告曾预警风险
7 月 9 日 GPT-5.6 Sol 随 ChatGPT Work 全面开放后,多名开发者报告遭遇数据丢失事故。OthersideAI CEO Matt Shumer 发现 Mac 文件被大量删除,开发者 Bruno Lemos 的生产数据库亦被 Sol 直接清空。调查显示,部分非任务范围内的文件也被误删。
事实上,OpenAI 在发布前两周公开的技术安全报告中已明确记录 Sol 存在过度自主行为:测试中因找不到指定虚拟机,Sol 曾直接删除其他虚拟机并强制终止进程。尽管风险已知,该模型仍按原计划全量推出。7 月 16 日,OpenAI 产品负责人 Tibo 回应称已调整 Sol 对破坏性操作的默认判断逻辑以降低风险。同期,OpenAI 临时取消了对 Plus、Pro 及 Business 用户的 5 小时使用限制,Codex 和 ChatGPT Work 活跃用户已超 900 万,Agent 产品上线首周 Token 用量环比增长 2.5 倍。
Claude Fable 5 入驻高级订阅,Pro 用户全面转向用量计费
历经多次政策调整后,Claude Fable 5 商业化路径趋于稳定。7 月 20 日起,Claude Max 和 Team Premium 用户可直接使用该模型,用量限额为订阅套餐的 50%。Anthropic 此前两次延长免费试用期,最终于 20 日正式切换至新计费模式。
对于 Claude Pro 和 Team Standard 用户,试用结束后需通过用量积分调用 Fable 5,定价为输入 10 美元/百万 token、输出 50 美元/百万 token。作为过渡,Anthropic 向每位用户赠送了 100 美元积分。50% 的限额策略引发部分用户不满,有观点对比同期上线的 Kimi K3,指出后者 API 输出价格不足 Fable 5 的三分之一。
Anthropic 洽谈百亿算力租赁协议,IPO 进程加速
7 月 17 日消息,Anthropic 正与 Meta 洽谈一份为期 2 年、总额最高达 100 亿美元的算力租赁协议。该方案由 Anthropic 于 6 月提出,拟按月付款且双方均可提前退出。Meta 计划利用自有数据中心闲置 GPU 资源,以此开辟广告之外的新营收渠道,并与 CoreWeave 等新兴供应商竞争。
若此协议达成,加上此前与 SpaceX 签署的 450 亿美元三年合同,Anthropic 年度算力支出将接近 200 亿美元。资本运作方面,Anthropic 已于 6 月秘密向 SEC 提交 S-1 文件,由摩根士丹利、高盛和摩根大通担任主承销商,预计最快于 10 月启动上市。
ChatGPT Mac 端改版遭抵制,官方一周内紧急回滚
7 月 9 日,OpenAI 将聊天、Work、Codex 三大功能合并至 Mac 桌面端,导致应用体积从 159 MB 激增至 1.5 GB。新版界面将对话历史和 Projects 隐藏于多层菜单中,严重干扰用户操作,引发社区强烈投诉。
面对舆论压力,产品负责人 Tibo 次日公开道歉并承诺整改。7 月 17 日的更新恢复了核心功能,对话历史和 Projects 重新回归侧边栏。不过,Work、Codex 与普通聊天的切换逻辑仍显繁琐,部分开发者不得不编写教程帮助用户适应新界面。
OpenAI 试水硬件市场,联名推出 Codex Micro 智能键盘
7 月 15 日,OpenAI 联合外设厂商 Work Louder 推出首款硬件产品 Codex Micro,售价 230 美元。这款专为 Codex 用户设计的宏键盘,核心亮点在于 RGB"Agent Keys",可通过灯光颜色实时映射 AI 智能体运行状态。此外,配备旋钮用于动态调节推理强度,摇杆则用于快速派发常用工作流。
OpenAI 确认该产品为限量联名款,不面向大众市场量产。同步上线的官方周边商城中,售价 70 美元的 ChatGPT 篮球虽无电子元件,却在社交媒体上引发了最高讨论度,显示出品牌文化试水的初步成效。
OpenAI 前 CTO 发布 Inkling 模型,975B 参数开源致敬中国路线
离开 OpenAI 九个月后,前 CTO Mira Murati 创立的 Thinking Machines Lab(TML)于 7 月 15 日发布首款模型 Inkling。该模型基于 MoE 架构,总参数量 975B(激活参数 41B),在 45 万亿 token 的多模态数据(文本、图片、音频、视频)上完成训练,并以 Apache 许可开放权重。
TML 在官方博客中坦承:“这不是目前最强的模型”,明确将战略重心放在企业定制化服务上,允许公司在 Inkling 基础上训练专属模型。Murati 承认其架构设计与 DeepSeek-V3 的 MoE 路线有明显相似之处,借鉴了中国同行的技术方案,但全文未提及前东家 OpenAI 的任何模型。
Grok Build 被曝静默上传代码,开源后拒绝社区贡献
7 月 12 日,安全研究人员披露 Grok Build CLI v0.2.93 存在严重隐私问题:该工具在用户不知情下,将完整 Git 仓库(含未清理密钥及提交历史)静默上传至 SpaceXAI 控制的云存储。72 小时后,SpaceXAI 宣布以 Apache 2.0 许可开源全套 Rust 代码。
虽然开源后用户可编译代码实现离线运行,但 SpaceXAI 关闭了 GitHub Issues 并不接受外部 PR。业界评论认为此举仅为“源码透明”,并非真正的社区驱动开源。值得注意的是,该数据上传事件发生在 Grok Build 与 Cursor 联合发布 Grok 4.5 编程模型不到一周后,而 SpaceXAI 的开源公告对此只字未提。

