大数跨境

中国大语言模型在OpenRouter平台的通话量连续第20周超越美国竞品

中国大语言模型在OpenRouter平台的通话量连续第20周超越美国竞品 科睿思国际
2026-09-28
11
导读:9月17日消息:在应用程序接口聚合平台OpenRouter上,尽管国产大语言模型在智能能力方面仍存在短板,但其周调用总量已连续第20周超过美国大模型。

中国大模型在OpenRouter调用量连续20周领跑

9月17日消息,尽管在顶尖智能能力上仍存差距,但中国大语言模型在应用程序接口聚合平台OpenRouter上的周调用总量,已连续第20周超越美国竞品。这一数据变化折射出全球AI市场关注点正从单纯的技术性能向“投入产出比”转移。

国产模型调用量占比近半,DeepSeek成新晋黑马

OpenRouter最新数据显示,9月7日至13日,全球大语言模型总调用量达127万亿token。其中,国产模型贡献了近61.2万亿token,占比显著;美国模型调用量为21.8万亿token。从环比增速来看,国产模型上涨7.9%,而美国模型大幅增长32%。

在具体模型排名中,美国OpenAI的GPT-5.6 Luna以18.2万亿token位居榜首,Hy4 preview以16.8万亿token位列第二。腾讯与Z.AI联合推出的GLM-5.3-Flash以11.9万亿token排在第三。值得注意的是,深度求索(DeepSeek)旗下多款模型表现强劲,V4-Flash-0731、V4.1-Flash、V4-Flash-0423分别位列第四、第六和第七;小米的MiMo-V2.5排名第五。前十榜单中,中国模型占据七席,远高于一年前的两款。

深度求索新发布的V4.1 Flash展现了极强的市场渗透力,发布后24小时内处理token量约1万亿。有开发者指出,AI用户仅用数小时便将其接入工作流,而非以往需要的数天时间。

行业焦点转向“Token投资回报率”,高性价比成核心竞争力

当前,大语言模型迭代节奏已从年度更新缩短至每周更新。9月上旬,包括Anthropic推出Claude Fable 5.1、OpenAI发布GPT-6 Astra在内的全球七家头部厂商完成了模型升级。然而,竞争格局呈现出明显分化:在性能层面,中国模型尚未进入前五,仅智谱AI与月之暗面跻身前十;但在调用量维度,中国模型凭借高性价比占据主导。

瑞银证券中国互联网行业分析师熊伟表示,随着AI进入大规模落地阶段,企业与用户的关注点正逐步从模型性能转向更高的投入产出比,“Token投资回报率”成为行业关键词。尽管中国模型在技术性能上不占绝对优势,但其成本效益受到越来越多开发者青睐。

OpenRouter数据显示,深度求索继续扮演“价格屠夫”角色。DeepSeek V4.1-Flash约90%的调用量来自缓存读取,每百万token成本约为0.6美分,较GLM-5.3-Flash等同类模型低约80%。GitHub开源项目研发团队认为,除非涉及底层复杂任务,否则应用层大部分任务无需花费数十倍成本使用顶尖模型,中国模型已能满足多数需求。

海外企业加速融入中国开源模型,盈利模式依赖技术优化

市场趋势显示,全球头部信息技术企业开始考虑将中国开源模型融入自身业务流程。熊伟指出,这一趋势在5月至6月明显加快,更多企业和开发者利用此类模型搭建工作流或处理特定任务。

尽管具备成本优势,中国模型开发商并未采取低价倾销策略推动普及。瑞银调查显示,这些企业的毛利率大多维持在20%至40%区间。其盈利水平与成本优势的维持,主要依靠创新的模型架构、优化的训练流程以及推理效率的提升,而非单纯的营销投入。

【声明】内容源于网络
0
0
科睿思国际
各类跨境出海行业相关资讯
内容 1275
粉丝 0
科睿思国际 各类跨境出海行业相关资讯
总阅读24.4k
粉丝0
内容1.3k