《每日经济新闻》根据 OpenRouter 最新数据测算,上周(9 月 14 日至 9 月 20 日)全球 AI 大模型总调用量为 129 万亿 Token,环比增长 1.57%。
其中,上榜的 AI 大模型中,中国 AI 大模型周调用量达 67.46 万亿 Token,环比增长 10.28%;同期美国 AI 大模型周调用量为 14.21 万亿 Token,环比下滑 34.7%。中国大模型周调用量连续二十一周超过美国,稳居全球首位。


《每日经济新闻》注意到,上周,全球调用量排名前五中,有四款中国 AI 大模型。其中,DeepSeek V4.1-Flash 升至第一,周调用量达 15.8 万亿 Token,环比增长 219%。
该模型于 9 月 10 日正式发布,在实现 Coding 与 Agent 能力提升的同时强化多模态理解能力。V4.1-Flash 采用全新的 Causal-Encoder-Decoder(因果编码器—解码器)结构,全局 KV Cache 降至 V4-Flash 的约 1/4。
架构优化释放推理降本空间。据 DeepSeek 官方定价,V4.1-Flash 每百万 Token 闲时缓存命中输入、未命中输入及输出价格分别为 0.02 元、1 元、4 元,较前代的 0.05 元、1.5 元、4.5 元分别下降 60.0%、33.3%、11.1%,高峰时段价格为闲时的两倍。
据 DeepSeek 介绍,DeepSeek V4.1-Flash 在性能、费用、速度和任务总用时等指标上已全面超越 V4-Pro。
中信证券认为,国产模型将沿高性价比与前沿智能两条路径继续展开竞争,DeepSeek 深度适配下国产算力基础设施与国产模型同步受益,同时高性价比推理将加速 FDE(前线部署工程师)及企业级 Agent(智能体)落地。
不过,Token 单价下降并不意味着单项任务总成本必然下降。据第三方机构 Artificial Analysis 的评测,在该机构测试中,V4.1-Flash 平均每项任务使用约 8.9 万输出 Token,高于上一代 V4 Flash 0731 的约 6.2 万。该机构评价 V4.1-Flash 的输出非常冗长(very verbose)。

智谱 GLM 5.3 Flash 位居第二,周调用量达 14.1 万亿 Token,环比增长 18%;腾讯混元 Hy4 preview 排名第三,周调用量达 12.5 万亿 Token,环比下滑 26%;DeepSeek-V4-Flash-0731(即 DeepSeek-V4-Flash 正式版)位居第五,周调用量达 9.44 万亿 Token,环比下滑 18%。
免责声明:本文内容与数据仅供参考,不构成投资建议,使用前请核实。据此操作,风险自担。
每日经济新闻


登录后才可以发布评论哦
打开小程序可以发布评论哦