大数跨境

DeepSeek输出涨到¥27,你的AI工具账单变了

DeepSeek输出涨到¥27,你的AI工具账单变了 琪琪智码
2026-08-19
4
导读:8月17日0时起DeepSeek API按新价扣费:输出¥6→¥27/百万token(峰值),缓存命中输入¥0.025→¥0.3,涨幅最高1100%。你白天用AI工具跑listing、翻译、客服,光输

8月17日0时起,DeepSeek API按新价格扣费。输出从¥6跳到¥27每百万token(峰值),缓存命中输入从¥0.025跳到¥0.3,涨幅最高1100%。你白天用AI工具listing、翻译、客服,光输出这一项成本就可能乘4.5,其他计费项涨幅各不相同,见下表。这篇帮你算清这笔账,再给三个问题逼服务商、两个动作把涨价挡住一半。

一、先把账打开:你白天每笔token都在按新价扣

先说清楚:这轮涨价不是均匀的「涨11倍」。11倍只对应缓存命中输入这一项。输出涨350%(从6到27),缓存未命中涨200%(从3到9)。别只拿「11倍」去跟服务商算账——它一句话就能把你顶回来。

V4-Pro新价格三栏对开,就是下面这张表。

峰值时段是北京时间9:00-12:00、14:00-18:00。这不是随便划的:这两段正是国内卖家和跨境服务商的白天工作时间。你上午十点跑一批listing文案、下午三点调一批五点描述,全踩在峰值价里。

闲时价恰好是峰值一半,但它只属于12:00-14:00、18:00后、清晨。周末是否算闲时官方没明确写,以最新计费说明为准。

你的AI工具真实成本,取决于三个变量:什么时候跑、哪个档位、跑什么内容。三者每个都能差出一倍甚至一个数量级。

二、同一件事,不同跑法差出一个数量级

判断你手头的AI任务该往哪个方向调整,先看三个维度:实时还是批量、重复还是新鲜、深度还是基础。每个维度对应一个省钱开关。

缓存命中与否,是最容易被忽视的暗器。 缓存未命中输入¥9,命中只要¥0.3,差30倍。你的品牌介绍、类目标题模板、系统提示词,这些每次调用都原样重复的内容,如果没有做成可复用前缀被缓存命中,就是在用30倍的价格喂它们。

模型档位是第二层差。 V4-Flash峰值输出¥9,是Pro峰值¥27的三分之一。翻译、分类、标签提取、基础改写这类不需要深度推理的活,跑Pro就是把钱往水里扔。除非你确实需要100万token上下文、38.4万token长输出,或者真要用到深度思考档,否则Flash完全够用。

时间档是第三层差。 错峰价正好是峰值一半。批量AI任务是天然的错峰选手:选品报表、库存告警、周报生成、批量翻译,全都推去12:00-14:00或18:00后跑。

举个例子:假设你用的某个Listing生成工具底层跑DeepSeek Pro,每天白天批量生成100条五点描述,每条约1万token输入、2000token输出(数字为便于计算的假设值)。改价前约¥4/天、月成本九十几块;8月17日后按峰值价约¥14/天、月成本三百多。同样这100条,错峰到18点后跑、输入命中缓存、输出切Flash,一天不到¥1.1,月成本二十几块——优化组合拳能把这轮涨价完全打回去。

服务商如果只用一个模型、一个档位、白天帮你跑所有任务,这轮涨价它没有任何优化余地,只能把成本转嫁给你的订阅费。有优化余地的服务商,在涨价前就该有预案。

三、问服务商三个问题,答案决定你还要不要付这个钱

第一问:底层用DeepSeek哪个模型、哪一档?涨价后订阅价何时变、按什么规则转嫁?

Pro和Flash价格差三倍。如果服务商底层跑的是Pro,你有理由问它一句:我的这些任务真需要Pro吗,还是你的代码没做模型路由?它说「我们成本涨了5倍」,你拿第一张图的账本跟它一项一项对:底层哪个档、涨了多少、转嫁给客户怎么算。

第二问:我的重复固定内容有做缓存命中优化吗?账单里缓存命中占比多少?

缓存命中¥0.3对比未命中¥9,30倍。服务商嘴上说「做了」没用,让它给账单数据。给不出占比数字,基本可以断定没做。一个没做缓存优化的工具,涨完价后你的品牌介绍每生成一次,都还在按未命中的价格扣钱。

第三问:批量任务支持错峰执行吗?价差让得出来吗?

闲时价是峰值一半,这是官方白纸黑字写的。服务商把你的批量任务全挤在白天峰值跑,多出来的一半成本,不该由已经付了订阅费的你吃下去。能错峰、能把价差让出来的,成本管理是实打实的;支支吾吾的,你自己品。

四、两个动作,现在动手

动作一:错峰。 把你所有非实时的AI任务调度到12:00-14:00、18:00后、清晨跑。输出从¥27降到¥13.5,缓存命中从¥0.3降到¥0.15——直接砍半。不用谈判、不用换工具,改个定时设置的事。局限:客服机器人、即时翻译这类实时任务躲不开峰值,这一半省不到它们头上。

动作二:缓存命中+模型降级。 把品牌资产库、类目标题模板、固定指令做成可复用前缀(prefill),让每一次调用的输入段命中缓存。同时把翻译、分类、基础改写这类轻任务切换到V4-Flash。两个动作叠加:输入成本从¥9压到¥0.3,输出成本从¥27压到¥9,输出费用直接省掉三分之二。局限:缓存命中的构建要看你的工具给不给自定义前缀接口。一键套模板、不开放底层参数的工具,做不了这个优化,那就只能换工具。

五、我的判断:这轮涨价只是开始

2026年5月,DeepSeek刚把限时优惠转成永久价格,价格一度降到原来的四分之一。不到三个月,调头涨价。同期智谱一季度累计提价83%,调用量反而涨了400%。全国日均token调用量从2024年初的1000亿token涨到2026年3月的140万亿token,涨了一千多倍。这不是DeepSeek一家的决策,是整个行业撑不住「低价换市场」了。

落到中小卖家身上,实际影响很清楚:AI工具订阅费会进入一轮普涨期。工具方不会自己把上游涨价的坑全填了,它一定在订阅费和套餐上找回来,只是早两个月晚两个月的问题。躲是躲不掉的,但用量结构可以先调对:非实时任务错峰、重复内容缓存命中、轻任务降档。这三条做不到,下个季度账单会很难看。

跨境电商SaaS工具对这轮涨价目前还没有公开表态。接下来几周如果收到涨费通知,把这篇的三个问题直接甩过去。

行动清单

1立即查:8月17日后的AI工具账单,和上月同任务量对比,算实际涨幅。

2今天就问服务商:底层哪个模型、缓存命中占比多少、错峰让不让价。

3批量任务挪到12:00-14:00或18:00后跑,闲时价直接省一半。

4把品牌介绍、类目标题模板整理成固定前缀,在服务商API的Prompt设置里配置成system prompt,让输入命中缓存。

5翻译、分类、基础改写等轻任务切V4-Flash,输出成本降到Pro的三分之一。

参考来源

新京报·贝壳财经:调价方案发布、峰谷时段划分、三档思考强度

财新网:V4-Pro调价前价格

世界浙商网(援引DeepSeek官网截图):闲时价格、V4-Flash价格

DeepSeek API官方文档:美元计价、上下文与最大输出规格

腾讯新闻(人民财讯):8月6日涨价预告公告

开源证券通信行业点评报告:日均token调用量数据、智谱提价与调用量数据

琪琪智码 QiCode

懂跨境业务的私有化系统服务商


订单中台 · 仓储 WMS · 履约物流 · 采购供应链

财务结算 · 数据中台 BI · AI 智能运营

私有化部署 · 源码交付 · 18+ 电商渠道对接

www.qiqicode.cn

点击文末「阅读原文」直达官网

系统选型、私有化部署,扫码加企业微信聊

本文由 AI 辅助创作,配图由 AI 生成;内容基于公开信息整理,仅供参考,不构成投资建议。

【声明】内容源于网络
0
0
琪琪智码
1234
内容 6
粉丝 0
琪琪智码 1234
总阅读6
粉丝0
内容6