全球大模型调用量前五均为中国产品,小米MiMo-V2.5登顶
小米MiMo-V2.5强势登顶,周调用量破10.5万亿Token
根据多模型聚合平台OpenRouter发布的7月20日至26日全球AI大模型调用量周榜单,小米自研的MiMo-V2.5模型以单周10.5万亿Token的调用量跃居榜首,环比增长12%。这也是该平台当周唯一突破10万亿Token级别的模型。小米集团董事长特别助理徐洁云在社交平台转发了这一消息,并指出该模型同时拿下周榜和月榜双料冠军——月度总调用量达31.20万亿Token,领先第二名DeepSeek V4 Flash的23.58万亿Token。MiMo-V2.5系列于4月23日公测并随后开源,采用混合专家MoE架构,总参数突破万亿,激活参数42B,标配100万Token超长上下文窗口,支持文本、图像、语音、视频全模态交互。其低廉的推理成本与稳定的智能体运行能力,是吸引海外开发者批量接入的核心优势。自5月以来,该模型海外调用量从1.46万亿Token一路攀升至10.46万亿,两个月累计增幅约616%。

腾讯Hy3增长超999%,国产模型包揽前五
榜单前五名全部为中国企业自研大模型,除小米外,DeepSeek贡献了两款产品,腾讯Hy3和智谱GLM-5.2也成功入围。其中,腾讯混元Hy3表现最为抢眼,位列第三,周调用量3.94万亿Token,环比增幅超过999%,成为榜单增长势头最猛的模型。该模型于7月6日正式开源,总参数295B,单次推理仅激活21B参数,采用快慢思考融合架构,最大支持256K上下文,在代码生成和智能交互方面大幅迭代。此前限时免费版本Hy3 (free)曾连续两周位居第一,随着免费版下架,付费版本调用量快速攀升,实现了从触达开发者到商业转化的成功过渡。智谱GLM-5.2以3.29万亿Token位列第四,环比下滑10%,该模型753B参数基座主打长周期工程任务处理,在代码和数据分析专项评测中居开源模型第一梯队。DeepSeek V4 Flash和V4 Pro分别位列第二和第五,周调用量分别为6.37万亿和3.17万亿Token,环比增长18%和17%,两者形成高低搭配,覆盖不同开发需求。
中国大模型全球份额超六成,连续十三周碾压美国
《每日经济新闻》根据OpenRouter数据测算,上周全球AI大模型总调用量为58万亿Token,环比下滑6.75%。其中,中国AI大模型周调用量达33万亿Token,是美国(2.34万亿Token)的14.1倍,且已连续十三周超过美国,稳居全球首位。OpenRouter官方此前披露,国产大模型全球市场份额早在6月初就已超越美国,截至7月26日,近28天国产AI模型全球占比升至63.5%,美国模型仅占35.5%,二者体量持续拉大。值得注意的是,此前一周排名第八、第九的Claude Opus 4.7和4.8双双跌出榜单,近一年来首次出现Anthropic旗下模型缺席榜单的情况,美国厂商在榜单中仅剩英伟达Nemotron 3 Ultra一款模型。阶跃星辰Step 3.7 Flash时隔两周再次冲上榜单,以1.92万亿Token位列第八,环比增长156%。
海外开发者用真金白银投票,国产开源打破生态壁垒
OpenRouter平台聚合了全球数万海外独立开发者及中小型AI应用的真实付费调用请求,所有Token用量统一计量,能够客观反映全球开发者的实际选择。国产开源模型能够在完全市场化的第三方渠道实现领先,意味着其正在打破海外厂商的生态壁垒。小米MiMo-V2.5、DeepSeek V4系列、腾讯Hy3、智谱GLM-5.2等均采用开源策略,且针对开发者需求优化了定价方案和上下文窗口。例如,小米对Token Plan定价方案进行了针对性优化,进一步降低门槛;DeepSeek全系标配1M上下文,轻量化Flash版本主打低成本快速推理,旗舰Pro版本代码和复杂智能体任务性能对标海外顶级闭源模型。不过,榜单存在局限性:国内互联网大厂自有App、企业私有化部署以及美国大厂封闭API流量均不在统计范围内,因此该数据仅作为海外开源赛道的观测窗口,但已足以证明中国AI模型在全球开发者市场中的强劲竞争力。