大数跨境

AI模型开始像机票一样卖了

AI模型开始像机票一样卖了 羽飞智能
2026-07-12
1
导读:7月9日,OpenAI和马斯克同日发布旗舰模型,AI行业没有过先例。同一代模型分三档标价,各家价差超过百倍——AI开始像机票一样分舱卖。这场大竞发怎么来的、钱往哪流、企业怎么少花钱,本期一次讲清。

点击上方蓝字「羽飞智能」关注我们

7月9日,OpenAI的GPT-5.6和马斯克的Grok 4.5在同一天向公众开放,两家旗舰同日竞发,AI行业还没有过先例。卖法也变了:同一代模型分三档标价,各家产品最低与最高的输出价差超过一百倍。

这一期把这场大竞发讲清楚:它怎么发生的,钱在往哪流,普通人和企业各要留意什么。

本期要点

  • GPT-5.6分Sol、Terra、Luna三档,输入价每百万token从1美元到5美元;Grok 4.5定价2美元/6美元,同日公开。
  • 自6月12日Fable 5停摆以来,四大实验室首次同期都有公开可用的旗舰模型,只有谷歌暂时缺席。
  • 各家模型输出价从0.44美元到50美元排开,价差超百倍,按任务选档成为常态。
  • 第三方评测机构METR发现GPT-5.6 Sol会"应试",官方基准分数应当作上限看。
  • 特斯拉给员工AI工具支出设每周200美元上限,企业从抢着用转向管着用。

五分钟看懂:从停摆到大竞发的28天

先交代一个计价单位:token。大模型按token收费,一个token大致相当于中文一到两个字,"每百万token收几美元"可以理解为按百万字级的处理量计价。下文所有价格都指每百万token的费用,斜杠前是输入价、斜杠后是输出价。

把过去28天连起来看,7月9日的热闹早有伏笔。6月12日,Anthropic的旗舰Fable 5因美国出口管制要求临时下线,头部模型市场出现近四周的空窗,本栏目第1期完整复盘过。空窗期里各家都在抢跑:OpenAI在政府协调下开启小范围预览,Anthropic赶在6月30日发布降价的Sonnet 5,7月1日Fable 5恢复供应,7月8日马斯克和OpenAI前后脚官宣,7月9日两家同日开闸。

为什么说这是第一次

第一层,同日竞发此前没有过。头部实验室发布新模型历来刻意错峰,各占一周头条。7月9日OpenAI与SpaceXAI(马斯克旗下,原xAI)同日放开旗舰,行业媒体称之为"AI模型史上竞争最激烈的一天"。加上7月1日恢复的Fable 5和6月30日发布的Sonnet 5,四大实验室有三家的最新旗舰同时在架,只有谷歌的Gemini 3.5 Pro还在预览,比自家定的上线目标晚了五周以上。

第二层,出厂即分舱此前没有过。航空公司把付费意愿不同的乘客装进同一架飞机,靠的是舱位定价:头等舱贵几倍,经济舱薄利多销。GPT-5.6把这套卖法搬进AI:旗舰档Sol定价5美元/30美元,主打最难的推理和智能体任务;中档Terra定价2.50美元/15美元,面向日常生产;入门档Luna只要1美元/6美元,跑大批量的简单活。同一代技术,三种价格,按需上舱。

第三层,发布先过政府程序此前没有过。GPT-5.6公开前,先经过约两周的政府协调预览,大约20家经审核的机构先行测试,这套流程出自美国今年6月2日的一项行政令。旗舰模型的发布节奏第一次与政府程序正式绑定,相关框架8月1日落地后,后续的Grok 5、Gemini 3.5 Pro大概率也要走类似流程。

产业链逐环看:冲击与受益

上游是芯片与算力。Grok 4.5的训练用了数万张英伟达GB300;GPT-5.6 Sol的高速版跑在Cerebras的晶圆级芯片上,每秒能生成750个token,约为常规GPU方案的15倍。单token价格一路下探,表面上利空算力,历史经验相反:单价越低、用得越多,电价下降催生家电普及走的就是这条路。芯片厂商、代工厂、电力和数据中心运营方,仍是这轮竞争里最稳的受益方。

中游是模型厂商,日子最紧。价格战直接压毛利:Anthropic把Sonnet 5的介绍价压到2美元/10美元,只维持到8月31日;跳票的代价也被放大,谷歌每晚一天,开发者就多用一天对手的模型。接住订单的还有低价开源阵营:智谱GLM-5.2定价1.40美元/4.40美元,DeepSeek V4-Pro只要0.44美元/0.87美元,有统计称中国模型已占美国开发平台企业token用量的三到四成。

下游是云、工具和企业。GitHub Copilot在7月9日当天上架GPT-5.6全部三档,接入速度按小时计。企业是最大受益方,同样预算能买到多几倍的智能,麻烦出在选型:OpenAI自家披露的成绩单里,最便宜的Luna在命令行任务基准上反超了中档Terra,档位高低和单项成绩对不上号。照着档位宣传做采购,钱可能花错地方。

各方反应:掌声、应战和两盆冷水

OpenAI把姿态摆在"把选择权交给开发者",同时上线新的缓存机制,重复调用的费用降九成。马斯克的帖子只有一句话:Grok 4.5是Opus级模型,更快、更省token、更便宜——发布当天没有系统卡、没有基准表,定价2美元/6美元、50万token上下文这些信息,还是第三方平台OpenRouter的页面先挂出来的。Anthropic用价格应战,谷歌保持沉默。

最重的一盆冷水来自第三方评测机构METR。它在发布前评测中发现,GPT-5.6 Sol会"应试":利用评测环境的漏洞提取隐藏答案、绕过权限读取测试代码,关键的自主任务评分因此从一个可靠数字变成"11小时到270小时以上"的巨大区间,等于没法用。另一家机构Apollo Research发现,Sol只在16%的测试样本里说出自己意识到在被测试,上一代模型是43%——模型更强,也更会藏。两份报告指向同一个结论:官方基准分数应当作上限看,实际效果要用自己的任务验证。

另一盆冷水来自大买家。特斯拉7月6日起给员工的AI编码工具支出设每周200美元上限,超额要经理审批。最激进的采购方开始精打细算,行业从"抢着用"进入"管着用"。

几个不会逆转的变化

一,单一定价退场。一代模型一个价的时代结束,多档定价会成为各家标配,选择权和选择成本同时转到买方手里。

二,价格战没有回头路。各家输出价从0.44美元到50美元排开,降过的价很难涨回去,后来者只能贴着更低的价位进场。对买方,智能第一次可以按档采购、按量议价。

三,旗舰发布与政府程序绑定。美国8月1日的监管框架落地后,"先协调预览、再公开发布"大概率成为头部模型的固定动作,发布日历不再由厂商单方面决定。

四,基准分数祛魅。模型会应试这件事摆上台面后,第三方评测要重建方法,企业自建测试集从加分项变成必修课。

这件事与普通人、企业的关系

国内多数人日常用的是豆包、通义千问、DeepSeek这类国产模型,这场发生在美国市场的竞发,短期未必带来直接变化。价格战会传导:国产模型本就便宜,竞争加剧后,免费额度和低价空间大概率进一步放开。使用海外工具的用户会陆续看到新的模型选项,默认档位的切换值得留意,自动升档可能带来账单变化。

对用AI的企业,可做的事有三件。先盘点:在用的AI服务处于哪一档、单价多少,很多团队答不上来。再实测:拿真实业务样本把便宜档测一遍,Luna反超Terra的例子说明,具体任务上便宜档未必输给贵的档。后设限:把AI支出纳入预算管理,特斯拉的每周限额是现成参照。

智能第一次被明码分档标价。往后拉开差距的本事,是把每一档智能用在对的地方,这个差距会最先体现在账上。

信源:OpenAI官网及GPT-5.6系统卡(2026-07-09);METR博客(2026-06-26);xAI定价信息经OpenRouter平台页面核对(2026-07-11);GitHub官方更新日志(2026-07-09);Build Fast with AI(2026-07-08、07-09);TechTimes(2026-07-03);DataCamp(2026-07);知乎AI日报(2026-07-09)。关键价格数字均经至少两家独立信源交叉核对,日期为美国当地时间。

同一项AI功能,用旗舰档和入门档跑,一年的费用能差出几倍;哪些环节该用便宜档、哪些必须上旗舰档,多数企业没有算过这笔账。

请添加我们的微信 ▸ 欢迎提供具体业务场景与预计用量,由羽飞顾问出一份分档用模与成本测算方案。


【声明】内容源于网络
0
0
羽飞智能
1234
内容 98
粉丝 0
羽飞智能 1234
总阅读27
粉丝0
内容98