上个月帮朋友看模型套餐,他截来三张对比图,价格差着好几倍。我说你先别比价,看眼日历。智谱 7 月底刚涨过价,腾讯云 8 月底刚改积分制,火山方舟 9 月刚改版。三家的规则今年全动过,你手里那张对比图,九成是旧规则画的。
模型是 Agent 的油。工具选错了换一个就行,油烧错一箱,要么月账单失控,要么额度半路断流,任务做到一半停摆。所以这篇不比参数,讲怎么买油不踩坑。
改版年这个名字是我起的。2026 年内,智谱 7 月 30 日涨价,入门档从 49 涨到 118;腾讯云 8 月 31 日改积分制;火山方舟 9 月改版。没有一家是两年前的老价格。所以买油第一步看页面上有没有写「截至 2026 年 9 月」,没有的教程直接关掉。
先说海外的结论,省得你纠结。海外模型认 OpenAI 最新旗舰就对了,写稿这天是 GPT-6 Astra。不用背型号,因为 OpenAI 几乎每季度换一代,背了三个月就过时。它任务执行稳这件事有两组硬证据,OSWorld 2.0 评测 72.6 分,比上一代少花一半时间;独立评测里平均 24 轮对话完成任务,上一代要 45 轮,Claude 要 60 轮。无人盯防时越权操作率 0%,上一代是 48%。这不是碾压,独立评测里它跟 Claude Fable 5.1 并列第一,所以 Claude 重度用户留在原地也是第一梯队。
但海外方案对中国用户有三道门,网络、支付、账号,任何一道过不了直接看国内。这也是昨天那篇选车的逻辑,今天买油同理。
国内买油的口径只有一句,不认厂商认模型,谁好用用谁。六家模型全部有官方接入通道,都能接进主流 Agent 工具,模型好就行,不用管它是谁家的。日常编码和 Agent 主力,GLM-5.3、Kimi K3、DeepSeek V4 是第一梯队;便宜够用选 DeepSeek V4-Flash,一百万 token 输入一块钱;超长文档选 K3,原生百万上下文还能看图。
真正难选的是套餐这一层。国产包月油卡有个共同点,它只给指定的编程和 Agent 工具加油,不是通用 API 余额。方舟和腾讯白纸黑字禁止把套餐额度用于程序直连 API。买之前先确认你的工具在支持列表里,三家都覆盖 Claude Code、Codex CLI 这些主流工具。
三家套餐按固定顺序看,先看模型能力和用量额度,再看价格,最后看模型丰富度。智谱是单品牌深绑定,套餐里只有 GLM 一家,但计量最透明,按 token 精确折积分,没有月度上限,重活不断流,代价是涨价后门槛最高,入门 118。火山方舟是一价多模型,40 块起步,豆包、DeepSeek、GLM、Kimi、MiniMax 随便切,试错成本全场最低,但计量按请求次数约数,重度会撞月上限。腾讯云是模型超市,39 起步就含 DeepSeek 原厂加 Kimi K3 加 GLM 全系,菜单最长,产品线也最多。
腾讯那条要单独提醒。Token Plan 是通用油卡,Coding Plan 是编程专用,CodeBuddy 会员是另一个工具的会员,三条线互不相通。看到推荐 CodeBuddy 会员的文章,先想清楚自己要买的是哪条线。
四句分场景结论。每天高强度用、认准 GLM,选智谱,非高峰时段积分五折。预算优先、想多试几个模型,方舟 Lite 40 块。要最大模型菜单、或公司已在腾讯云,腾讯 Token Plan 39 起。低频用户夜间批处理,别买订阅,直接 DeepSeek 按量 API,小工作量一个月几块钱。
两个提醒值回票价。一是榜单罗生门,Terminal-Bench 2.1 和 4.0 的排名不一致,OpenAI 已经因数据污染弃用了 SWE-bench Verified,厂商自报分数普遍好看,别拿单一榜单当真理。二是换模型有隐性折损,Claude Code 这类工具为 Anthropic 自家模型调优,接第三方模型效果会打折,谁好用用谁,但换的时候拿真实任务重新试一遍。
上手就三步。先按量试,三家都有按量或免费额度,拿真实任务试一周。从最低档买起,所有订阅不支持退款。重活排非高峰,智谱工作日下午 2 到 6 点以外加周末全天,积分五折。
最后说说那个日历。我朋友圈已经看到两篇讲模型套餐的文章,价格全是旧的,评论区一片「怎么跟官网对不上」。改版年买油,看日历这个动作,本身就是基本功。三家的改版都发生在 2026 年内,下次改版不会提前打招呼,但官网价格页永远是最新的。买之前刷一眼,比任何横评都管用。

