精彩的一周,AI 领域迎来密集发布与重大商业变动。
本周 AI 快讯 | 1 分钟速览
01 DeepSeek-V4-Pro 正式版上线,Harness 开源公测,8 月 17 日起实施峰谷定价:1.6 万亿参数 MoE 模型权重以 MIT 协议开源;高峰时段输出价格上调至 27 元/百万 token。
02 阿里千问同周双发「Qwen3.8」系列:27B 版本编程能力超越 Plus 版,新增推理强度调节;2.4T 旗舰模型开放权重,原生支持 256K 上下文。
03 智谱发布 GLM-5.3:基座不变,依靠后训练 Scaling 使编程能力提升 50%,权重计划两周后开放。
04 Manus 脱离 Meta 恢复独立运营:发改委首次依据安全审查制度叫停 AI 领域外资收购,部分用户需在 8 月 23 日前备份数据。
05 MiniMax-Music3 开源发布:双 LLM 架构支持生成长达 5 分钟的完整歌曲,最低 8GB 显存即可运行。
06 OpenAI 预览 GPT-5.6 Sol Ultrafast 模式:由 Cerebras 芯片驱动,推理提速 14 倍,最高达 750 token/秒。
07 ChatGPT 广告扩展至 5 个新市场:企业 AI 收入已超越消费者业务,Plus 用户可付费重置每周额度。
08 Anthropic Q2 营收破 115 亿美元并首次盈利:计划 10 月以 2 万亿美元估值 IPO,Claude Sonnet 5 促销价永久化。
09 Claude 文本水印全球上线引发争议:为满足欧盟法规嵌入不可见水印,部分用户因此退订。
10 谷歌推出 Gemini 3.7 Flash:半价专攻编程与智能体,Gemini 月活突破 10 亿成谷歌增速最快产品。
11 SpaceX 完成 600 亿美元收购 Cursor:Grok 4.6 在多项基准上追平 GPT-5.6 Sol,支持多智能体协作。
12 英伟达开源 Nemotron 3.5 Lightning:30B 参数仅激活 3B,专为智能体执行层设计,速度提升 30%。
13 Meta 开源 Muse Glimmer 30B:单卡即可运行的本地智能体模型,支持 100 多种语言及 131K 上下文。
DeepSeek-V4-Pro 正式上线,全线实施峰谷定价
8 月 13 日,DeepSeek 正式发布 V4-Pro-0813 正式版,App、网页端及 API 同步更新。该模型拥有 1.6 万亿参数(激活 490 亿),原生支持 OpenAI Responses API 并适配 Codex,在编程和智能体场景表现接近顶尖水平。权重已按 MIT 协议开源,利于国产 GPU 私有化部署。
同日,对标 Claude Code 的 DeepSeek Harness v0.1 以 MIT 协议开源,提供四种运行模式。自 8 月 17 日零时起,DeepSeek 全线实行峰谷定价策略。V4-Pro 高峰时段(北京时间 9:00-12:00、14:00-18:00)输出价格调整为 27 元/百万 token,输入价格为 9 元;非高峰时段价格减半。V4-Flash 系列同步调价。
阿里千问双发 Qwen3.8,小模型编程超越 Plus 版
8 月 14 日,阿里千问团队开源 Qwen3.8-27B 模型。这款 270 亿参数模型在编程和办公场景表现优于 Qwen3.7-Plus,并新增 reasoning_effort 功能,可按需控制思考深度以节省资源。
此前一日,阿里开放了旗舰模型 Qwen3.8-2.4T-A95B 的权重。该模型采用 2.4 万亿参数 MoE 架构(激活 950 亿),原生支持 256K 上下文。评测显示,其在 PaperBench 和 IFBench 等基准中位居前列,与主流顶级模型互有胜负。
智谱发布 GLM-5.3,后训练 Scaling 显著提升编程能力
8 月 14 日,智谱发布 GLM-5.3。该模型未改动基座代码,完全依靠后训练 Scaling 实现能力跃升,编程能力较上一代提升 50%。Terminal-Bench 3.0 得分从 4.6 飙升至 28.3,DeepSWE v1.1 从 46.2 提升至 66.9。
目前「GLM Coding Plan」已全量上线。模型权重计划在发布约两周后,经安全评估后对外开放。
Manus 恢复独立运营,发改委叫停 Meta 收购案
8 月 11 日,Manus 宣布恢复独立运营。国家发改委依据外商投资安全审查制度,否决了 Meta 约 20 亿美元收购 Manus 的交易,这是该制度实施以来首例公开叫停的 AI 领域外资收购案。
为满足监管要求,2025 年 12 月 29 日后创建的用户数据将于 8 月 23 日至 24 日期间删除。受影响用户需在 8 月 23 日 07:59 前完成备份。Meta 与 Manus 已切断数据共享,Manus 员工不再访问 Meta 内部系统。
MiniMax-Music3 开源,AI 生成 5 分钟完整歌曲
8 月 14 日,MiniMax 推出音乐生成模型 MiniMax-Music3。该模型采用双 LLM 架构(8B Global + 0.6B Local),基于 Qwen3-8B 初始化,可生成长达 5 分钟的 32kHz 立体声歌曲。
模型支持歌词段落标记及详细的曲风、BPM 等描述控制。权重已在 Hugging Face 开源,兼容 SGLang、diffusers 和 ComfyUI,通过逐层卸载技术,最低仅需 8GB 显存即可运行。
OpenAI 预览 Ultrafast 模式,推理速度提升 14 倍
8 月 14 日,OpenAI 发布由 Cerebras 芯片驱动的 GPT-5.6 Sol Ultrafast 模式预览版。其推理速度高达 750 token/秒,是标准模式的 14 倍,目前已向部分 API 客户开放。
同期,Mac 版 ChatGPT 上线 Computer History 功能,提供桌面活动记录与时间回溯;Linux 桌面端预览版也于 8 月 12 日推出,支持多产品线。
ChatGPT 广告扩容,企业收入首超消费者业务
8 月 11 日,OpenAI 将 ChatGPT 广告测试扩展至英国、日本、韩国等 5 个新市场。广告仅面向 Free 和 Go 层级成年用户,付费及企业用户不受影响。
CFO Sarah Friar 透露,7 月企业 AI 业务收入环比增长 32%,首次超过消费者业务。此外,OpenAI 正在测试 Plus 用户支付 8 美元即时重置每周额度的功能。
Anthropic Q2 首次盈利,拟 10 月冲击 IPO
8 月 15 日披露数据显示,Anthropic 2026 年 Q2 营收超 115 亿美元,同比增长逾 14 倍,并首次实现约 5.59 亿美元的运营利润。公司计划于 10 月以 2 万亿美元估值进行 IPO。
同时,Anthropic 宣布将 Claude Sonnet 5 的促销价格永久化,取消了原定的 9 月涨价计划,以稳固企业客户群体。
Claude 全球上线文本水印,合规举措引争议
为满足欧盟《人工智能法案》透明度要求,Anthropic 自 8 月初起在全球范围为 Claude 生成的文本嵌入不可见机器水印。该水印在复制粘贴甚至部分修改后仍可保留。
此举引发部分用户担忧代码等项目暴露 AI 使用痕迹而退订,但也有观点认为这有助于建立信任。同期,Chrome 侧边栏上线了完整的 Claude Cowork 会话体验。
谷歌 Gemini 月活破 10 亿,Flash 新版半价上线
8 月 13 日,谷歌推出专为编程和智能体设计的 Gemini 3.7 Flash,定价仅为上一代的一半。该模型在 DeepSWE 等基准上表现显著提升,输出速度达 340 token/秒。
两天前,谷歌宣布 Gemini App 月活跃用户突破 10 亿,成为其史上增速最快的产品。其中 63% 的用户通过语音交互,苹果用户规模已超 1 亿。
SpaceX 完成 Cursor 收购,Grok 4.6 性能追平顶尖
8 月 14 日,SpaceX 对 Cursor 母公司 Anysphere 的 600 亿美元收购正式生效,Cursor 并入 SpaceXAI 团队。预计 2027 年该项目将贡献约 130 亿美元收入。
同期发布的 Grok 4.6 在多项智能指数基准上与 GPT-5.6 Sol 持平。新推出的 Grok Bot 支持多智能体全天候协作,SpaceXAI 计划到 2027 年底将数据中心电力容量扩大至 10GW。
英伟达开源 Nemotron 3.5,智能体任务提速 30%
8 月 12 日,英伟达发布 Nemotron 3.5 Lightning。这款 300 亿参数 MoE 模型仅激活 30 亿参数,专为智能体执行层设计,输出速度达 1200 token/秒,任务完成速度比同级模型快 30%。
该模型在 SWE-bench Verified 上得分大幅提升至 51.56%,事实准确度指标领先同类。4-bit 量化后可在消费级显卡上运行。
Meta 开源 Muse Glimmer,单卡运行本地智能体
8 月 10 日,Meta 发布 Muse Glimmer 30B 模型。这款稠密多模态模型支持 100 多种语言和 131K 上下文,针对本地智能体场景优化。
经 4-bit 量化后,显存占用压缩至 18-20GB,单张消费级显卡即可流畅运行,支持编程、文件整理及自动失败重试等功能。

