根据OpenRouter最新一周数据,全球AI大模型总调用量达到115万亿Token,环比增长1.77%。中国AI大模型周调用量为56.72万亿Token,环比增长2.83%,在上榜模型口径下贡献约56%的份额,继续领跑全球;同期美国AI大模型周调用量为16.54万亿Token,环比下滑3.1%。这已经是中国模型连续第十九周超过美国,且上周全球调用量排名前五中有四款来自中国。
中国模型本周的增长并非均匀分布。腾讯混元Hy4 preview是重要的拉动力量,其周调用量达到14.7万亿Token,位居全球第一,环比增长379%,为中国整体调用量提供了一个明显的向上脉冲。从平台调用结构看,编程和智能体任务正在成为Token消耗的主要来源。这类任务通常不是短问答,而是需要模型反复调用工具、读写长上下文、在较长的任务链条中持续生成内容,单个工作流产生的Token消耗远高于普通对话。因此,在长上下文、代码能力和工具调用上表现稳定,同时调用成本更可控的模型,更容易在聚合平台获得开发者的持续使用。
与中国的增长形成对比,美国AI大模型同期周调用量为16.54万亿Token,环比下滑3.1%,与中国模型的差距进一步拉大。上周全球调用量前五中,中国模型占据四席,头部集中度已经十分清晰。腾讯混元Hy4 preview单款模型14.7万亿Token的周调用量,已经接近美国全部上榜模型的当周调用量,这说明中国模型的优势不只体现在总量份额,也体现在头部产品的实际用规模上。
调用量增长对算力最直接的影响集中在推理侧。与训练阶段的一次性高投入不同,每一次API调用都会产生新的推理计算;当智能体和编程工作流把单次任务拉长,Token消耗与算力占用还会进一步放大。

中国模型份额上升,意味着全球推理负载中更大一部分由国产模型承接,这会持续推高对服务器、推理芯片、数据中心供电和冷却能力的需求。长期来看,这场竞争的焦点也不只是模型参数或榜单排名,还包括单位Token背后的推理成本与供给稳定性。
对数据分析师和行业观察者而言,这份周度数据提供的不只是一个排名变化。调用量增速、头部模型的贡献、中美差距的变化方向,以及编程与智能体场景在Token消耗中的位置,共同构成判断行业热度的关键指标。后续更值得关注的,是中国模型能否在高占比基础上继续压制推理成本,把调用量优势转化为可持续的产业能力。
关于文章版权的声明:
https://news.softunis.com/72926.html 文章来自软盟资讯
若非本站原创的文章,特别作如下声明:
本文刊载所有内容仅供提供信息交流和业务探讨而非提供法律建议目的使用,不代表任何监管机构的立场和观点。不承担任何由于内容的合法性及真实性所引起的争议和法律责任。
凡注明为其他媒体来源的信息,均为转载,版权归版权所有人所有。
如有未注明作者及出处的文章和资料等素材,请版权所有者联系我们,我们将及时补上或者删除,共同建设自媒体信息平台,感谢你的支持!
