2026 年 7 月,大模型行业迎来竞争烈度与维度的双重升级。在谷歌 Gemini 3.5 Pro 发布前夕,OpenAI 首款消费硬件曝光,Anthropic 与 OpenAI 的用户争夺战进入白热化阶段。
三个模型,三条路径
Gemini 3.5 Pro 的延期发布折射出行业信号。谷歌放弃接近完成的基础模型重新预训练,旨在构建结构性优势:200 万 token 上下文窗口及 Deep Think 推理层。其定价策略将 Deep Think 锁定于每月 250 美元的 Ultra 套餐,API 定价约为 GPT-5.6 Sol 的四分之一,试图通过能力分层驱动营收增长。
GPT-5.6 系列经安全审查后于 7 月 9 日全球发布,涵盖 Sol、Terra、Luna 三档模型,支持 150 万 token 上下文,API 价格仅为 Claude Fable 5 的一半。OpenAI 同步取消 Codex 使用限制并征集应用案例,迅速抢占市场。
相比之下,Anthropic 因算力紧张导致 Fable 5 付费切换多次推迟。政策的不确定性引发用户不满,大量用户在社交平台展示退订凭证,表示若现状不改将转向 GPT-5.6 或 Grok 4.5。
开源阵营攻入腹地
7 月成为开源模型发展的转折点。LLMCheck 报告显示,智谱 GLM 5.2 在 SWE-Bench Pro 得分 68.5%,首次在智能体编程基准上超越 GPT-5 和 Claude。GLM 5.2、DeepSeek R3、Kimi K3 三款中国开源模型均采用 MIT 协议,并标配 100 万 token 原生上下文窗口,大幅刷新行业标准。
Hugging Face CEO 德朗格指出,约半数财富 500 强企业已将其作为核心工具。企业路径呈现明显规律:初期依赖商业 API,当日调用量突破百万次时,开源模型的成本优势即刻显现。为保持中立立场以维系社区信任,Hugging Face 拒绝了 NVIDIA 的大额投资。
这一趋势验证了算法创新对算力封锁的消解作用。正如《DeepSeek 启示》所述,该模型以极低训练成本和推理定价,证明了新一代模型的高效能。
AI 制药:下一个兑现窗口
AI 价值正从模型竞赛延伸至产业落地,制药领域成为最新试金石。Anthropic 发布面向科学家的 ClaudeScience 并启动自主药物研发;同期,英矽智能宣布 AI 研发新药 Rentosertib 启动 III 期临床试验,并与武田制药达成最高 6 亿美元的全球合作。
大厂军备竞赛持续升温,字节、阿里、腾讯在 AI 领域的资本开支均达千亿级别,加速推动技术向实体经济渗透。
边界在消融
三年间,大模型行业完成了通常需要十年的结构演化。竞争维度已从单一的性能跑分,扩展为“模型能力×定价策略×生态绑定”的三重博弈。Gemini 凭借上下文窗口溢价,OpenAI 依靠性价比获客,Anthropic 受困于算力瓶颈。而在巨头身后,开源社区正在重塑行业规则。

