7 月 31 日,DeepSeek 正式开启最新大语言模型 DeepSeek-V4-Flash 的 API 公测。官方数据显示,该版本在代理能力上实现大幅升级,基准测试得分显著超越 V4-pro 预览版。
极致性价比:运行成本不足竞品百分之一
据美国研究机构 Artificial Analysis 最新测试,DeepSeek-V4-Flash 已成为全球主流模型中运行成本最低的一款。其每百万输入 Token 收费 0.14 美元,输出 Token 收费 0.28 美元。经加权平均计算,完成每项智能指数任务的平均成本仅为 3 美分,不到 Anthropic 旗舰模型 Claude Fable 5(3.15 美元)的 1/100。
作为对比,中国竞争对手月之暗面的 Kimi K3 任务成本为 86 美分,OpenAI 的 GPT-5.6 Sol 为 1.86 美元。Artificial Analysis 指出,相较于单纯对比定价,基于“完成任务所需处理数据量”的成本核算方式更能真实反映模型价值。若模型需更多步骤才能得出结论,即便单价较低,实际综合成本依然高昂。
性能评测:智能指数得分 50 分
在性能表现方面,DeepSeek-V4-Flash 在该机构的“智能指数”评测中获得 50 分(满分 100 分)。该指数综合了编码、推理及职场风格任务等九项基准测试结果。
具体排名显示,V4-Flash 得分与谷歌 Gemini 3.6 Flash 持平,略低于 Meta Muse Spark 1.1 及智谱 GLM-5.2(低 1 分)。而在业界旗舰梯队中,Kimi K3 得分为 57 分,Anthropic Claude Opus 5、Fable 5 以及 OpenAI GPT-5.6 均达到 59 分或以上。
市场反响:中国模型霸榜全球调用量前五
凭借极具竞争力的 API 价格与优秀的模型能力,DeepSeek 在过去一年迅速在全球开发者市场建立影响力。随着 V4-Flash 的发布,Token 成本进一步降低,促使大量海外企业接入其 API,平台调用量快速增长。
全球多模型聚合平台 OpenRouter 发布的最新周榜显示,AI 大模型调用量排名前五的产品均由中国企业研发。其中,小米 MiMo-V2.5 以单周 10.5 万亿 Token 的调用量登顶榜首;DeepSeek-V4-Flash、腾讯 HY3、智谱 GLM-5.2 以及 DeepSeek-V4Pro 分列第二至第五位。

