大数跨境

AGI市场观察(2026年9月12日至18日)

AGI市场观察(2026年9月12日至18日) 综合开发研究院
2026-09-24
0
导读:前三位和前五位大模型分别贡献了超半数和超四分之三的词元用量份额


日前,智能经济30人论坛AGI测评中心发布最新一期《AGI市场观察》(2026年9月12日-18日)。报告以OpenRouter词元消耗数据、各厂商官方披露价格及Arena基准测评为基础,对国产大语言模型做周度量化追踪,本期围绕用量、份额、集中度、价格与性价比等方面给出观察。智能经济30人论坛是由综合开发研究院(中国·深圳)等机构联合发起,汇聚全国人工智能、数字经济领域的专家学者与企业家,共同推动智库交流与合作。






AGI市场观察

第二期

2026年9月12日-9月18日



向下查看速报









本期主要观察

01

词元用量观察:

四款“轻量级”大模型词元用量超过10万亿,DeepSeek V4.1 Flash得益于定价下调周用量增长明显


02

市场份额观察:

DeepSeek V4 Flash、DeepSeekV4.1 Flash、Hy4 preview、GLM5.3 Flash在中国大模型中的词元用量份额同处 “第一梯队”


03

市场集中度观察:

头部集聚态势不变,前三位和前五位大模型分别贡献了超半数和超四分之三的词元用量份额


04

综合价格观察:

本周Top15大模型每百万tokens最高价与最低价相差38.75元,多数厂商延续低价策略


05

性价比观察:

DeepSeek V4.1 Flash、Hy4 preview、GLM 5.3 Flash 等大模型同处“经济好用”区间

01

词元用量观察

  • 四款“轻量级”大模型词元用量超过10万亿,DeepSeek V4.1 Flash得益于定价下调周用量增长明显


本周中国大模型词元用量Top 15

数据来源:OpenRouter

数据说明:取本周窗口(2026-09-12 ~ 09-18)内各中国大语言模型在 OpenRouter 的词元消耗量前15名,按本周用量降序排列。字节跳动Seed系列大语言模型缺乏有效数据,本期测评未纳入。


本周Top 15中国大模型较上周词元用量变化情况

数据来源:OpenRouter

数据说明:取本周窗口(2026-09-12 ~ 09-18)内各中国大语言模型在 OpenRouter 的词元消耗量前15名,对比其上周窗口(2026-09-05 ~ 09-11)词元消耗量。


02

市场份额观察

  • DeepSeek V4 Flash、DeepSeekV4.1 Flash、Hy4 preview、GLM5.3 Flash在中国大模型中的词元用量份额同处 “第一梯队”


本周Top 15中国大模型词元用量份额占比

数据来源:OpenRouter

数据说明:取本周窗口(2026-09-12 ~ 09-18)内各中国大语言模型在 OpenRouter 的词元消耗量前15名,分别计算其词元消耗量占全部中国大语言模型词元消耗量占比。计算结果为四舍五入结果,可能存在数据加总不统一的情况,下同。



本周Top 15中国大模型词元用量份额占比变化

数据来源:OpenRouter

数据说明:取本周窗口(2026-09-12 ~ 09-18)内各中国大语言模型在 OpenRouter 的词元消耗量前15名,计算其本周窗口和上周窗口(2026-09-05 ~ 09-11)词元消耗量占全部中国大语言模型词元消耗量比重变化。


03

市场集中度观察

  • 头部集聚态势不变,前三位和前五位大模型分别贡献了超半数和超四分之三的词元用量份额


中国大模型词元用量CR3与CR5情况

数据来源:OpenRouter

数据说明:取本周窗口(2026-09-12 ~ 09-18)和上周窗口(2026-09-05 ~ 09-11)内各中国大语言模型在 OpenRouter 的词元消耗量前3/5名,计算其本周和上周词元消耗量占全部中国大语言模型词元消耗量占比变化。



中国大模型词元用量CR3与CR5市场份额较上周变化

数据来源:OpenRouter

数据说明:取本周窗口(2026-09-12 ~ 09-18)和上周窗口(2026-09-05 ~ 09-11)内各中国大语言模型在 OpenRouter 的词元消耗量前3/5名,计算其本周和上周词元消耗量占全部中国大语言模型词元消耗量占比变化。


04

综合价格观察

  • 本周Top15大模型每百万tokens最高价与最低价相差38.75元,多数厂商延续低价策略


本周词元用量Top 15中国大模型综合价格

数据来源:各厂商官方披露价格

数据说明:取本周窗口(2026-09-12 ~ 09-18)内各中国大语言模型在 OpenRouter 的词元消耗量前15名计算综合价格(输入价格:输出价格=3:1)。数据采集窗口期Dots3-Note Preview、Nex-N2.5 Pro、DeepSeek V3.2(官方API已下线)未公开披露模型具体价格。


05

性价比观察

  • DeepSeek V4.1 Flash、Hy4 preview、GLM 5.3 Flash 等大模型同处“经济好用”区间


本周词元用量Top 15中国大模型基准任务成本

数据来源:Arena

数据说明:根据汇率(美元:人民币=1:6.7)计算。



Top 15中国大模型基准任务成本 vs 净确认成功率分布情况

数据来源:Arena

数据说明:“净确认成功率” (Confirmed Success)指用户通过界面按钮明确标记“任务完成”的频率,表示为各模型相对随机化基线(代表平均模型)的百分点差(正值表示高于平均模型,负值表示低于)。范围为收录的全球款主流大语言模型。第三方数据未披露MiMo-V2.5、Dots3-Note Preview、Nex-N2.5 Pro、Qwen3.8 Flash、DeepSeek V3.2基准任务成本数据。







【声明】内容源于网络
0
0
综合开发研究院
中国(深圳)综合开发研究院,是顺应中国改革开放发展的形势和需要,于1989年2月在深圳经济特区创办的国内第一家综合性、政策性、全国性的新型智库。2015年入选首批25家国家高端智库建设试点单位。www.cdi.org.cn
内容 3894
粉丝 0
综合开发研究院 中国(深圳)综合开发研究院,是顺应中国改革开放发展的形势和需要,于1989年2月在深圳经济特区创办的国内第一家综合性、政策性、全国性的新型智库。2015年入选首批25家国家高端智库建设试点单位。www.cdi.org.cn
总阅读13.9k
粉丝0
内容3.9k