全球Token消耗量持续攀升,DeepSeek大模型登顶调用榜。
在AI Agent等应用场景的带动下,全球Token消耗量还在持续攀升。根据OpenRouter最新数据测算,上周(5月18日到5月24日)全球AI大模型总调用量达到28.9万亿Token,比前一周增长了7.4%,这已经是调用量连续第五周上涨,说明大模型需求还在持续释放。
从榜单来看,上榜的中国AI大模型周调用量合计9.22万亿Token,环比增长19.89%;而美国AI大模型的周调用量为4.93万亿Token,环比增长16.27%。中国大模型的周调用量已经连续四周超过美国,稳居全球第一。截至目前,DeepSeek-V4-Flash已经登顶OpenRouter的全球AI大模型调用榜。OpenRouter是一个AI模型聚合与调用平台,提供透明的Token级监控和计费系统,主要是帮开发者解决接口碎片化、密钥管理复杂和成本控制等问题。平台用户以海外开发者为主,中国开发者只占大约6%。
在国内,Token调用量大幅增长也早就不稀奇了。根据国家统计局的数据,2026年3月,仅国内日均Token调用量就突破了140万亿;豆包的日均使用量也在三个月内翻倍,达到120万亿。中金公司测算,在中度使用场景下,当Agent渗透率达到8%时,Agent的总Token消耗量就已经跟Chatbot相当了。Agent的普及对Token消耗有明显的乘数效应,随着单任务复杂度、使用时长和渗透率的协同提升,有望推动日均Token消耗实现5倍以上的增长。
随着Token消耗量与日俱增,“Token工厂”和“Token运营商”也开始陆续落地。根据各公司官网信息,中国移动4月21日推出了面向个人用户的Token算力服务产品,支持DeepSeek、Qwen等主流大模型,最低5.99元就能买个次包;中国电信5月17日正式推出系列试商用Token套餐,面向中小微客户的基础版定价39.9元/月;中国联通上海分公司5月16日宣布向上海OPC客户提供Token服务。与此同时,中国电信已经发布了“Token工厂”生成能力服务集中采购项目的招标公告。天风证券指出,AI数据中心正在向“Token工厂”演进,对大规模数据处理能力的需求越来越突出。
中信证券表示,Token工厂和Token运营商的出现,标志着Token生成能力从附属功能变成了可计价的标准化服务,这将推动算力租赁市场从当前以“裸金属”服务器租赁时长为基础的固定月租模式,转向按实际Token用量计费的模式。该机构强调,当Token成为算力的计价单位,算力租赁服务商就能充分享受到Token需求持续膨胀带来的红利,以及所有AI应用场景高速渗透的机遇。算力租赁行业当前的高景气度主要源于国内算力市场的供需错配,这使得掌握高端算力芯片资源的头部租赁公司卡位优势更加突出。综合赛道景气度和当前行业逐渐出清、向头部集中的趋势,看好头部算力租赁厂商在Token用量新一轮增长中的弹性空间。





