日前,智能经济30人论坛AGI测评中心发布最新一期《AGI市场观察》(2026年9月12日-18日)。报告以OpenRouter词元消耗数据、各厂商官方披露价格及Arena基准测评为基础,对国产大语言模型做周度量化追踪,本期围绕用量、份额、集中度、价格与性价比等方面给出观察。智能经济30人论坛是由综合开发研究院(中国·深圳)等机构联合发起,汇聚全国人工智能、数字经济领域的专家学者与企业家,共同推动智库交流与合作。
AGI市场观察
第二期
2026年9月12日-9月18日
向下查看速报
本期主要观察
01
词元用量观察:
四款“轻量级”大模型词元用量超过10万亿,DeepSeek V4.1 Flash得益于定价下调周用量增长明显
02
市场份额观察:
DeepSeek V4 Flash、DeepSeekV4.1 Flash、Hy4 preview、GLM5.3 Flash在中国大模型中的词元用量份额同处 “第一梯队”
03
市场集中度观察:
头部集聚态势不变,前三位和前五位大模型分别贡献了超半数和超四分之三的词元用量份额
04
综合价格观察:
本周Top15大模型每百万tokens最高价与最低价相差38.75元,多数厂商延续低价策略
05
性价比观察:
DeepSeek V4.1 Flash、Hy4 preview、GLM 5.3 Flash 等大模型同处“经济好用”区间
01
词元用量观察
四款“轻量级”大模型词元用量超过10万亿,DeepSeek V4.1 Flash得益于定价下调周用量增长明显
本周中国大模型词元用量Top 15
数据来源:OpenRouter
数据说明:取本周窗口(2026-09-12 ~ 09-18)内各中国大语言模型在 OpenRouter 的词元消耗量前15名,按本周用量降序排列。字节跳动Seed系列大语言模型缺乏有效数据,本期测评未纳入。
本周Top 15中国大模型较上周词元用量变化情况
数据来源:OpenRouter
数据说明:取本周窗口(2026-09-12 ~ 09-18)内各中国大语言模型在 OpenRouter 的词元消耗量前15名,对比其上周窗口(2026-09-05 ~ 09-11)词元消耗量。
02
市场份额观察
DeepSeek V4 Flash、DeepSeekV4.1 Flash、Hy4 preview、GLM5.3 Flash在中国大模型中的词元用量份额同处 “第一梯队”
本周Top 15中国大模型词元用量份额占比
数据来源:OpenRouter
数据说明:取本周窗口(2026-09-12 ~ 09-18)内各中国大语言模型在 OpenRouter 的词元消耗量前15名,分别计算其词元消耗量占全部中国大语言模型词元消耗量占比。计算结果为四舍五入结果,可能存在数据加总不统一的情况,下同。
本周Top 15中国大模型词元用量份额占比变化
数据来源:OpenRouter
数据说明:取本周窗口(2026-09-12 ~ 09-18)内各中国大语言模型在 OpenRouter 的词元消耗量前15名,计算其本周窗口和上周窗口(2026-09-05 ~ 09-11)词元消耗量占全部中国大语言模型词元消耗量比重变化。
03
市场集中度观察
头部集聚态势不变,前三位和前五位大模型分别贡献了超半数和超四分之三的词元用量份额
中国大模型词元用量CR3与CR5情况
数据来源:OpenRouter
数据说明:取本周窗口(2026-09-12 ~ 09-18)和上周窗口(2026-09-05 ~ 09-11)内各中国大语言模型在 OpenRouter 的词元消耗量前3/5名,计算其本周和上周词元消耗量占全部中国大语言模型词元消耗量占比变化。
中国大模型词元用量CR3与CR5市场份额较上周变化
数据来源:OpenRouter
数据说明:取本周窗口(2026-09-12 ~ 09-18)和上周窗口(2026-09-05 ~ 09-11)内各中国大语言模型在 OpenRouter 的词元消耗量前3/5名,计算其本周和上周词元消耗量占全部中国大语言模型词元消耗量占比变化。
04
综合价格观察
本周Top15大模型每百万tokens最高价与最低价相差38.75元,多数厂商延续低价策略
本周词元用量Top 15中国大模型综合价格
数据来源:各厂商官方披露价格
数据说明:取本周窗口(2026-09-12 ~ 09-18)内各中国大语言模型在 OpenRouter 的词元消耗量前15名计算综合价格(输入价格:输出价格=3:1)。数据采集窗口期Dots3-Note Preview、Nex-N2.5 Pro、DeepSeek V3.2(官方API已下线)未公开披露模型具体价格。
05
性价比观察
DeepSeek V4.1 Flash、Hy4 preview、GLM 5.3 Flash 等大模型同处“经济好用”区间
本周词元用量Top 15中国大模型基准任务成本
数据来源:Arena
数据说明:根据汇率(美元:人民币=1:6.7)计算。
Top 15中国大模型基准任务成本 vs 净确认成功率分布情况
数据来源:Arena
数据说明:“净确认成功率” (Confirmed Success)指用户通过界面按钮明确标记“任务完成”的频率,表示为各模型相对随机化基线(代表平均模型)的百分点差(正值表示高于平均模型,负值表示低于)。范围为收录的全球款主流大语言模型。第三方数据未披露MiMo-V2.5、Dots3-Note Preview、Nex-N2.5 Pro、Qwen3.8 Flash、DeepSeek V3.2基准任务成本数据。

