DeepSeek调用量全球第一 连续21周超美国
据OpenRouter最新数据,9月14日至20日,全球AI大模型总调用量达129万亿Token,环比增长1.57%。中国大模型周调用量已连续21周超过美国。上周全球调用量排名前五中有4款来自中国。
中国的大模型周调用量已经实现连续21周的持续增长, 并且在这个过程中始终碾压美国的相应数据, 不过目前排名第一的那个模型的单价确实是降低了, 但是总的成本却并没有随着单价的下降而同步降低, 在这里存在着一个很容易被大家忽略的问题。
中美差距拉到五倍
在9月14日到20日这段时间里, 全球范围内的 AI 大模型被调用的总次数达到了 129 万亿 Token。这个数据跟上一周期比起来, 增长幅度是 1.57%。我们再来看具体的国家情况。中国的大型模型在这周的调用量达到了 67.46 万亿。
这个数值环比增长了 10.28%。而美国的调用量则是 14.21 万亿。这个数字相比之前下降了 34.7%。中国的调用量到目前为止已经连续 21 周超过美国了。两者之间的差距甚至扩大到了将近接近 5 倍之多。
美国这一周里面大约减少了7.4万亿这样一个数量的Token, 而在同样的时候段之中, 中国方面大约增加了约6.2万亿。那么在一减和一增这样子的一个情况下面, 这在过去21个周期所积累下来的领先的那个优势依然还依然在不断地变大, 这个是绝不是一个短短时间内的随机波动就可以说清楚的一个现象的。
全球前五坐满中国选手
在上周全球调用量的排名前五名里面, 有四款产品是来自中国的。V4.1-Flash凭借15.8万亿Token的用量, 一下子冲到了第一位, 和上一周期相比, 数量大幅增长了219%。
智谱GLM5以14.1万亿的规模排在第二的位置。腾讯混元以12.5万亿居第三位。而V4-Flash-0731则以9.44万亿占据了第五名的席位。
排在第四名的那个唯一挤进前五位的不属于中国的模型, 它的出现表明了一种情况。中国产的模型包揽了四个席位, 这种高集中度的现象如果放在两年前, 是绝对不敢去想象的。这个事实说明了国产大模型的调用生态已经是成形状态了。
第一名的技术账本
V4.1-Flash版本是在9月10日这一天发布的, 这个版本主要提升了Agent以及多模态理解的能力, 全局KV Cache的消耗降到了前代的大约四分之一。
在闲时的时候, 每百万Token的成本情况是这样的: 输入缓存命中是0.02元, 没有命中的时候是1元, 输出的费用是4元, 这些费用比起前代分别降低了百分之六十、百分之三十三点三以及百分之十一一点一。
KV _cache_被压缩到了原来的四分之一, 这就意味着每次请求所需要的内存空间大幅度地减少了, 同时上下文的 managing 变得更加高效了, 这也就是为什么它在发布之后仅仅过去了四天, 其调用量就能够暴增百分之二百一十九的底层技术支撑所在。
单价降不等于成本降
经过实际的测试数据展示, 可以发现V4.1-Flash这款产品在处理平均每一项任务的时候, 大约需要调用8.9万的输出Token数量。相比之下, 同类的其他竞争产品大概只需要6.2万个Token。
从最终的输出质感来看, 这种内容表现被评估为有些过于啰嗦和冗长。因此, 如果当需要处理的任务规模大量增加之后, 其产生的总体费用成本, 并不见得就能像预期的那样比前一代产品的花费要低出很多来。
把单价降到原来的七成, 但是使用量增加了大概是百分之四十三那样, 去算总的账目出来以后, 会发现可能仅仅节省了一点点钱, 甚至完全没有节省下来钱。企业在选择相关模型的时候, 不能只去看标价这一项, 而是需要根据实际的任务完成数量还有输出的长度去计算总的成本花费。
第二第三各有打法
GLM5的周调用量达到了14.1万亿, 这一数据让它稳稳地占据了第二名的位置, 该模型的优势主要集中在长文本处理以及代码生成场景里表现出的稳定性方面, 腾讯混元的周调用数为12.5万亿, 因此排在第三位, 它的强大之处体现在生态绑定上, 依托微信和企业微信内部嵌入的人工智能能力, 直接推动了调用量的增长。
编号为V4-Flash-0731的这个版本排在第五位, 它的调用量达到了九点四五万亿。它是V4.1-Flash这个新一代版本的前一代。现在还有非常多已经在使用该服务的用户没有进行迁移操作。所以导致老旧版本的调用数量还能继续维持一阵较长的时间。
下一个悬念在哪
美国那边的调用量在连日下降, 这到底是临时的现象还是长久的趋势。要是下个季度在美国有好多新模型集中出现的话, 中国保持了二十一个星期的领先记录还能不能继续下去, 这是一个需要我们持续去关注的事情。
另一个悬念是价格战。输入缓存命中价已经打到0.02元每百万Token, 利润空间被压到极薄, 厂商接下来靠什么回血, 这是下一个关键问题。
你心中在想, 关于中国大型模型在使用次数方面所存在的优势, 是否能够顺利挺过美国即将到来的新一轮大模型的发布大关呢? 大家可以在评论区位置来聊聊这件事儿, 如果你感觉到这个内容确实是有用的话, 请帮忙点赞, 并且转发分享给你的朋友。