《每日经济新闻》根据 OpenRouter 最新数据测算,上周(9 月 7 日至 9 月 13 日)全球 AI 大模型总调用量为 127 万亿 Token,环比增长 10.43%。
其中,上榜的 AI 大模型中,中国 AI 大模型周调用量达 61.17 万亿 Token,环比增长 7.85%;同期美国 AI 大模型周调用量为 21.76 万亿 Token,环比增长 31.56%。中国大模型周调用量连续二十周超过美国,稳居全球首位。


《每日经济新闻》注意到,上周,全球调用量排名前五中,有四款中国 AI 大模型。其中,腾讯混元 Hy4 preview 位居第二,周调用量达 16.8 万亿 Token,环比增长 15%。
Hy4 preview 于 8 月 28 日正式发布并开源,总参数 770B、激活参数 49B,上下文长度突破 1M,重点面向 Agent、Coding 与生产力场景优化,增强在真实业务场景中完成复杂任务的能力。
智谱 GLM 5.3 Flash 位居第三,周调用量达 11.9 万亿 Token,环比下滑 4%;DeepSeek V4 Flash 0731(即 DeepSeek V4 Flash 正式版)位居第四,周调用量达 11.6 万亿 Token,环比下滑 6%;小米 MiMo-V2.5 升至第五,周调用量达 7.77 万亿 Token,环比增长 230%。
DeepSeek V4.1 Flash 登上榜单,排名第六,周调用量达 4.94 万亿 Token。该模型于 9 月 10 日正式发布。V4.1 Flash 采用全新的 Causal-Encoder-Decoder(因果编码器—解码器)结构,是一个总参数量为 552B 的混合专家模型(MoE)。
价格方面,DeepSeek 下调了 V4.1 Flash 的 API 定价。按每百万 Token 计算,空闲时段的缓存命中输入价格为 0.02 元、缓存未命中输入为 1 元、输出为 4 元;高峰时段分别为 0.04 元、2 元和 8 元。新价格 2026 年 9 月 10 日 12:00 开始生效。
与此前 V4 Flash 同一时段的价格相比,缓存命中输入降价 60%,未命中输入降价约 33.3%,输出降价约 11.1%。
据 DeepSeek 介绍,DeepSeek V4.1 Flash 在性能、费用、速度和任务总用时等指标上已全面超越 V4 Pro。

值得注意的是,此前一周排名第六的 MiniMax M3、排名第九的智谱 GLM 5.3 跌出榜单。
免责声明:本文内容与数据仅供参考,不构成投资建议,使用前请核实。据此操作,风险自担。
每日经济新闻


登录后才可以发布评论哦
打开小程序可以发布评论哦