行业观察:顶尖大模型的高价逻辑正在瓦解。随着头部厂商集体降价与性能下探,AI 智能正从“稀缺资源”加速转向“普惠基础设施”。
01
三件事撞进同一时间窗
7 月 30 日至 31 日,大模型市场接连发生三起关键事件:OpenAI 宣布 GPT-5.6 系列大幅降价并提速;DeepSeek 发布 V4 Flash-0731 正式版,官方指标显示其性能逼近 Opus 4.8,部分项目超越 GLM-5.2;智谱 AI 同步调整订阅套餐并提升价格。
表面上看,智谱涨价与 DeepSeek 推新似乎形成了尴尬的“撞车”,但厘清时间线可知,两者公告仅相差一天,并无直接因果博弈。这一系列动作背后折射出的核心趋势是:顶尖大模型维持高价的理由正在消失。
02
价格体系率先松动
数据比姿态更诚实。DeepSeek-V4-Flash-0731 的定价策略极具破坏力:缓存命中输入仅需 0.02 元/百万 tokens,未命中为 1 元,输出为 2 元。这意味着在高频缓存场景下,算力成本已低至可忽略不计,从需要审批的开支变成了随手可用的开关。
与此同时,OpenAI 也将 Luna 和 Terra 系列价格下调至原来的两成。尽管两家厂商路径独立,但第一梯队模型集体降价的趋势已无法掩盖。价格,成为了行业格局变动中第一块松动的砖。
03
能力迈入“替代区”门槛
低价若无性能支撑则毫无意义。Flash-0731 的关键突破在于,其在保持极低价格的同时,能力已进入“替代区”。虽然不同评测基准存在差异,不宜直接断言其全面超越竞品,但其表现已足以让用户认真考量:为何要为昂贵模型支付十倍溢价?
过去,廉价模型仅是预算紧张时的“备胎”;如今,它们已成为必须严肃对待的“选项”。从备胎到可选方案的跨越,其战略分量远超排行榜上的名次更迭。
04
高价模型定位上移而非消失
高价模型并未失效,而是发生了定位迁移。真实工作流正呈现分层态势:高价模型专注于规划、判断及最终决策等容错率极低的环节;而批量改写、代码补全、日志分析等大量执行性任务,则交由 Flash 类模型处理。
在一个典型的 Agent 任务链中,真正需要顶级智力的调用可能仅有数次,其余均依赖单价与速度。高价模型输掉的不是技术竞争,而是“包揽全流程”的旧有定位。当执行层被廉价智能填满,高价模型仅能守住判断与决策的高地,这已不足以支撑覆盖全链条的高昂价目表。
05
重演云计算的成本曲线
这一进程与云计算的发展轨迹高度相似。服务器曾是从昂贵稀缺到按量付费、按需扩容的过程。历史经验表明,真正改变市场的并非单次性能领先,而是成本与入口门槛的双重下降。
当算力昂贵时,人们仅在关键处使用;当算力便宜到可忽略,它将被铺设进每一个角落。Flash 类模型的定价并非短期促销,而是智能从“稀缺资源”转变为“随手可取的基础设施”的拐点信号。
06
溢价故事的终结
无论是智谱调价、OpenAI 降价还是 DeepSeek 压价,均指向同一事实:“顶尖大模型理应昂贵”的行业默认规则正在瓦解。过去的溢价建立在能力稀缺的基础上,而当“够用且便宜”的选项充斥替代区,稀缺前提便不再牢固。
这不是某家公司的困境,而是整个第一梯队面临的共同挑战:当智能不再稀缺,高价的合理性何在?
07
通往 AGI 的另一条路径
传统观念将 AGI 想象为云端高高在上的超级模型,仅供少数人偶尔请教。然而,若智能始终昂贵,它注定只是被供起来的珍品。另一条路径正在显现:不追求单个模型的绝对全能,而是让智能像水电一样便宜、普及,无处不在。
Flash-0731 虽未实现 AGI,却揭示了这一方向:智能正变得越来越近、越来越便宜。AGI 的终点或许并非让人仰望超级模型,而是让每个人、每个软件、每个 Agent 都能随时调用近乎无限的智能。本周的价格表,似乎已在替我们回答这个问题。

