大数跨境

AI账单来了,全行业开始省钱

AI账单来了,全行业开始省钱 羽飞智能
2026-07-02
2
导读:AI账单来了。这周OpenAI亮出自研省电芯片,几家大公司的AI账单集中爆雷,Uber4个月花光一年预算。风向变了,从拼命烧钱转向精打细算。省钱办法很朴素——别用最贵的工具干最简单的活。

点击上方蓝字「羽飞智能」关注我们

这周全球AI圈没冒出什么惊天新模型,真正热闹的是另一件事:算账。6月24日OpenAI亮出第一颗自研芯片,同一周几家大公司的AI账单集中爆雷,整个行业头一回把省钱两个字摆到台面上说。

过去两年,大家比的是谁用得多、谁烧得狠;这一周,风向明显变了,比的是谁花得值。这条主线,和你店里、厂里怎么用AI,关系比想象中近。

一颗芯片,把"省钱"摆上了台面

6月24日,OpenAI和芯片公司博通一起发布了自研芯片Jalapeño。它不追求训练大模型,专门干一件事——让训练好的模型跑起来更省电、更便宜,也就是行内说的"推理"。据两家披露,从画图纸到流片只用了9个月,早期测试显示每瓦性能比现有主流明显更好,计划年底先上线。

翻译成大白话:AI公司自己动手造更省钱的发动机。原因不复杂,模型天天被几亿人调用,电费和芯片钱压得喘不过气,只能从硬件上抠成本。OpenAI说这只是第一代,接下来还要和微软等伙伴一起铺大规模数据中心。这也是个信号——连最舍得花钱的OpenAI,都开始盯着每一度电算账了。

账单先一步来了,有人4个月花光一年预算

芯片是远水,账单是近渴。6月1日起,程序员常用的GitHub Copilot把固定月费改成了按用量收费——用多少扣多少。第一个完整账期一到月底结算,不少重度用户傻眼了:有人晒出账单,从原来每月几十美元,跳到几百甚至上千美元,热门的自动写代码功能尤其烧钱。

企业这边也不好过。据CNBC和多家外媒报道,网约车公司Uber承认,2026年的AI预算在头4个月就花光了,高管直言这笔钱"越来越难交代"。还有外媒提到,一家医疗企业半年里用掉上万亿次调用,多花了六百多万美元,财务部门事后才搞清钱花在了哪。前两年那套"能用就多用、用得多就是先进"的打法,被外媒起了个名字叫烧token,如今账单一到,热度肉眼可见地退了。

省钱的办法,其实很朴素

怎么省?行业给出的答案朴素得出人意料:别拿贵的干粗活。市面上模型的价差大到离谱,最便宜和最贵的能差几千倍,最便宜的处理一百万字符只要几美分。可很多公司图省事,简单任务也一律上最贵最强的模型,钱就这么白烧了。

对应的做法有个朴素的名字,叫"给任务派对模型":来一个活,先判断难易,简单的派便宜模型,难的才动用贵的,中间由一套程序自动分流。据报道,用上这种办法,不少企业把成本砍掉了六到八成,用起来几乎没差别。说白了,就是把AI当水电一样精打细算,而不是敞开了用。这套思路不玄,普通公司照着做也不难。

大盘还在涨,但风向真的变了

数据来源:OpenAI/博通、CNBC、GitHub官方、Gartner,核实于2026年6月30日;数字为各方披露口径。

别误会,这不是AI要降温。据咨询机构Gartner预测,2026年光是AI智能体软件这一块,全球花费就会到2065亿美元,比去年涨了约139%。钱还在大把往里投。

变的是花钱的姿势:从"越多越好",转向"花得值不值"。这轮转向对做实事的公司反而是好消息——芯片降本、模型降价,同样一件活,明年后年只会更便宜。我们在一线做AI应用,最直接的感受就是:一年前算不过账的方案,今年很多都能算平了。

和你生意的关系

第一,别用最贵的工具干最简单的活。发个通知、整理台账、回答常见问题这类重复小事,便宜的AI就够了,把贵的留给真正难的活,一个月能省下不少。

第二,按用量付费的时代,先算清一笔活多少钱。越来越多AI工具改成用多少付多少,上手前先估个量、设个上限,别被"随便用"套进去,月底才发现账单吓人。

第三,不用急着一次性重投。芯片和价格都在往下走,眼下先挑一两个最痛的环节小步试——比如报价、对账、客服——跑通了再扩,比一口气砸钱稳当得多。


【声明】内容源于网络
0
0
羽飞智能
1234
内容 98
粉丝 0
羽飞智能 1234
总阅读27
粉丝0
内容98