9月第一周,OpenRouter的调用量数据呈现了两个容易混淆的结论:中国AI大模型周调用量连续第十九周超过美国,以及腾讯混元Hy4 preview周调用量环比增长379%。二者对应的是不同统计口径,但共同指向一个变化——中国模型在开发者与业务场景中的使用强度正在继续抬升。

先看总量。上周(8月31日至9月6日)全球AI大模型总调用量为115万亿Token,环比增长1.77%。这个增速不高,说明整体盘子没有突然放大。更值得注意的是结构性差异:中国AI大模型周调用量为56.72万亿Token,环比增长2.83%;美国为16.54万亿Token,环比下滑3.1%。中国模型的调用体量已经明显高于美国模型,并且还在扩张。
从数据看,腾讯混元Hy4 preview上周排名第一,周调用量达14.7万亿Token,环比增长379%。这种涨幅通常对应新品发布后的集中采用,而非长期稳态增速。Hy4 preview在8月28日发布并开源,距离统计周期结束只有约一周,开发者迁移和测试会快速反映到调用量上。因此379%更多体现的是发布窗口的爆发力,不能直接外推成每周都能保持的速度。
腾讯模型快速起量的原因
把它简单归为脉冲也不完整。连续十九周领先说明中国模型不是靠单点爆发,而是有持续的调用基础。腾讯Hy4 preview能够快速登顶,与其产品定位和技术特征直接相关。
从公开参数看,Hy4 preview总参数770B,激活参数49B,上下文长度突破1M,重点面向Agent、Coding与生产力场景优化。激活参数远小于总参数,意味着推理时实际参与计算的参数规模被控制,有助于在长上下文和高频调用中降低计算成本。这在Agent和编程任务中很关键,因为这类场景往往需要多轮、长链条交互,上下文一旦不够,就会出现信息丢失或反复重试。
开源策略也推动了采用速度。企业可以自行部署、评估和适配,不必把所有调用都绑定在外部API上。对需要长期维护Agent或编程工具的企业,这种可控性会影响选型。
榜单变化释放的信号
上周全球调用量排名前五中,有四款中国AI大模型。同期美国AI大模型周调用量环比下滑,意味着在统计周内,中国模型从新增调用中拿走了更多份额。
榜单变化也显示了竞争强度:前一周排名第三的小米MiMo-V2.5、排名第九的Gemini 3.7 Flash跌出榜单。调用量排名并非稳定结构,发布节奏、开源策略和场景适配都会在短时间内改变位置。腾讯Hy4 preview的上升,本质上是一次产品更新叠加开源传播形成的快速替代。
如何用调用量评估模型价值
对企业技术负责人来说,单一周调用量不能直接等同于模型能力。更合理的方式是把它和几个指标一起看:趋势是否连续,增长是否来自真实业务场景,开源和上下文能力能否降低后续集成成本。
调用量高至少说明开发者愿意反复使用,背后是模型在某类任务中可被接受。腾讯Hy4 preview快速起量,除了新发布效应,也与其面向Agent、Coding和生产力场景的优化有关。这类场景对稳定性和上下文长度要求更高,如果模型在实际业务中频繁失败,调用量很难在短时间内快速攀升。
当前数据说明,中国模型在调用侧已经形成规模优势,腾讯Hy4 preview则提供了一个新的观察样本。如果企业正在评估是否引入这类模型,与其盯着单周排名,不如观察发布后几周调用量能否稳定,以及在自己的Agent、代码生成和长文档任务中是否持续降低失败率。这才是把榜单数字转化成选型依据的关键。
关于文章版权的声明:
https://news.softunis.com/72898.html 文章来自软盟资讯
若非本站原创的文章,特别作如下声明:
本文刊载所有内容仅供提供信息交流和业务探讨而非提供法律建议目的使用,不代表任何监管机构的立场和观点。不承担任何由于内容的合法性及真实性所引起的争议和法律责任。
凡注明为其他媒体来源的信息,均为转载,版权归版权所有人所有。
如有未注明作者及出处的文章和资料等素材,请版权所有者联系我们,我们将及时补上或者删除,共同建设自媒体信息平台,感谢你的支持!
