大数跨境

AI 涨价 80%,调用量反涨 400%:免费时代结束了

AI 涨价 80%,调用量反涨 400%:免费时代结束了 AI造万物
2026-09-22
5
导读:国内大模型集体涨价:输出价一年涨 80%,智谱提价 83% 调用量反增 400%。拆解涨价背后的算力与商业逻辑,以及普通用户、开发者、企业分别要重算的哪笔账。

去年所有人都在比谁更便宜,今年比的是谁敢涨价。

摩根士丹利的一组数字,把这个反转钉死了:2026 年二季度,国内八家主流大模型的平均 API 输出价格是 21.9 元/百万词元,比 2025 年一季度涨了约 80%;输入价也从 3.3 元涨到 4.9 元,涨幅 48%。

但真正反常识的不是涨价本身。

是涨价之后发生的事:智谱年内连提三次价,累计涨幅 83%,调用量不降反升,一季度同比增长 400%。

越贵,用的人越多。这不符合我们对价格战的全部直觉。

免费时代,可能真的结束了。

涨价的不是一家,是一整排

这不是某个厂商的单独动作,而是一次集体转身。

2 月,智谱打响第一枪,发布 GLM-5 海外版的同时上调 Coding Plan 价格;3 月 GLM-5-Turbo 发布,API 再涨 20%;4 月 GLM-5.1 又涨 10%。6 月,MiniMax 发布第三代旗舰 M3,API 价格全面翻倍。7 月,月之暗面发布 Kimi K3,输入价涨到 20 元/百万 Token、输出价 100 元,前者涨超 3 倍、后者涨近 4 倍。

DeepSeek 的动作最耐人寻味。8 月 6 日它发公告称"计划近期整体上调 API 服务定价,预计涨幅较大"。新价格分高峰与空闲两档,还引入缓存命中与未命中的差异化定价——缓存命中的高峰价格涨到了原价的 12 倍。

云厂商也没闲着。3 月阿里云、百度智能云同步调整 AI 算力产品价格,涨幅分别在 5%~34% 和 5%~30%;腾讯云年内连续两次涨价,理由都写着"全球 AI 算力需求激增、核心硬件供应链成本大幅上涨"。

就在同一时间窗口,OpenAI 反向操作:轻量级模型 Luna 降价 80%,输入从每百万 Token 1 美元砍到 0.2 美元;中端 Terra 降 20%;只有旗舰 Sol 一分没动。

一边集体涨价,一边精准降价。这不是混乱,是两套完全不同的生存逻辑。

撑不住的原因:两条传导链

第一条是算力。

长上下文、深度推理、Agent 任务,把推理负载拉到了一个新量级。OpenAI 披露过一个细节:Codex 驱动的智能体任务,已经占据其每周输出 Token 总量的 99.8%。

智能体会自己循环、自己重试、自己调用工具——一次任务的 Token 消耗,是普通问答的几十倍。当调用量指数级增长时,每百万 Token 对应的真实算力成本,没法靠规模效应等比例摊薄。高峰时段的 GPU 供给依然紧张,成本只会往上走。

第二条是商业模式,这条更致命。

阿里、字节、腾讯有自有算力集群和云业务,模型 API 对它们来说是云服务的引流入口,不是利润中心——亏得起,甚至愿意亏。

独立厂商没有云生态兜底。API 收入是它们核心甚至唯一的收入来源。成本倒挂,除了提价没有第二条路。

智谱 CEO 张鹏说得很直白:"长期依赖低价竞争并不利于整个行业发展,能力升级带来成本上升是自然结果。"

400% 的反常识:企业在为什么买单

涨价没有吓跑客户,这件事值得单独拆开看。

有开发者此前透露过一个判断:在极低价格区间内,开发者对价格弹性几乎趋近于零——价格即便翻倍,Token 消耗量也不会明显下降。

原因不复杂。企业买的从来不是 Token,是"这件事能不能被可靠地完成"。

一个能替掉三个人力的客服 Agent,每月推理成本从 2000 涨到 6000,ROI 依然是正的。但如果它不稳定、会胡说、高峰期掉链子,再便宜也没人敢上生产环境。

所以客户在为确定性付费。

涨价还顺带完成了一次筛选。有厂商统计过,早期免费额度的消耗中,40% 来自没有实际业务场景的测试调用;某厂商甚至发现超过八成的 Token 成本在"空转"。适度涨价把薅羊毛流量清洗掉,反而让留下来的优质客户拿到了更稳定的服务。

这就是"良币驱逐劣币"的现实版本。

分化:留在牌桌上的,和退出牌桌的

涨价潮同时加速了行业分层。

头部独立厂商活得不错:月之暗面 ARR 两个月从 3 亿美元翻到 10 亿美元;智谱的 GLM 系列全面入驻 Google Vertex AI、AWS Bedrock;月之暗面还在跟微软、亚马逊、谷歌谈托管 Kimi K3,从销售中拿最高 30% 的分成。

腰部就没这么幸运了。百川智能裁撤约 70% 员工,整体转向医疗 AI;零一万物停止万亿参数以上通用大模型训练,收缩到垂直行业定制;Manus 把团队迁往新加坡,最终被 Meta 收购。

2025 年 AI 模型层公司全年只完成 22 笔融资,单轮 10 亿元以上的只集中在智谱、MiniMax、月之暗面三家。

"百模大战"收束成了"头部独立厂商 + 大厂生态"的二元结构。

这跟你有什么关系:三笔账要重算

如果你只是普通用户:短期影响有限,DeepSeek 等产品的普通用户日常使用仍保持免费。但豆包已上线三档会员(688 到 5088 元一年),千问 App 也悄悄上了付费服务(办公助理专业会员 200 元、568 元、1499 元三档)。免费额度收紧、高级功能收费,是明确的方向。

如果你是开发者或小创业公司:这是冲击最大的一层。把整个技术栈押在单一低价模型上的做法,风险已经暴露——你的成本结构可能在某个早晨被一条公告改写。现在该做的是做多模型路由、压缓存命中率、把长上下文和重复调用砍掉。

如果你在企业里做采购:别只比"每百万 Token 多少钱"。输入/输出、缓存命中与否、峰谷、上下文长度、多模态,各家计费口径五花八门。真正该看的是首 Token 时延、成功率、纠错率——低价伴随低质的情况下,实际总成本(TCO)并不低。

一句大实话:AI 不会越来越便宜了。它只会越来越"值这个价"。

最后

智谱 CEO 张鹏说,2025 年的关键词叫"智能上界",进入 2026 年,关键词变成了"Token 量"。

这句话是整个行业的分水岭:从证明自己有多聪明,转向证明自己能赚多少钱。

对我们这些用 AI 的人来说,心态也得跟着换——别再问"哪个最便宜",该问"哪个能真的把活干完"。

毕竟,一个能替你干完活的模型涨了 80%,和一个便宜但干不完活的模型,前者其实更省钱。


你现在每个月为 AI 花多少钱?如果常用那个明天宣布涨价三倍,你会减少使用,还是照旧?评论区聊聊。

【声明】内容源于网络
0
0
AI造万物
科技改变生活。
内容 20
粉丝 0
AI造万物 科技改变生活。
总阅读460
粉丝0
内容20