每日经济新闻 16小时前
是美国的4.7倍!中国AI大模型周调用量连续二十一周领跑:DeepSeek V4.1-Flash登顶,环比增长219%
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_keji1.html

 

《每日经济新闻》根据 OpenRouter 最新数据测算,上周(9 月 14 日至 9 月 20 日)全球 AI 大模型总调用量为 129 万亿 Token,环比增长 1.57%。

其中,上榜的 AI 大模型中,中国 AI 大模型周调用量达 67.46 万亿 Token,环比增长 10.28%;同期美国 AI 大模型周调用量为 14.21 万亿 Token,环比下滑 34.7%。中国大模型周调用量连续二十一周超过美国,稳居全球首位。

《每日经济新闻》注意到,上周,全球调用量排名前五中,有四款中国 AI 大模型。其中,DeepSeek V4.1-Flash 升至第一,周调用量达 15.8 万亿 Token,环比增长 219%。

该模型于 9 月 10 日正式发布,在实现 Coding 与 Agent 能力提升的同时强化多模态理解能力。V4.1-Flash 采用全新的 Causal-Encoder-Decoder(因果编码器—解码器)结构,全局 KV Cache 降至 V4-Flash 的约 1/4。

架构优化释放推理降本空间。据 DeepSeek 官方定价,V4.1-Flash 每百万 Token 闲时缓存命中输入、未命中输入及输出价格分别为 0.02 元、1 元、4 元,较前代的 0.05 元、1.5 元、4.5 元分别下降 60.0%、33.3%、11.1%,高峰时段价格为闲时的两倍。

据 DeepSeek 介绍,DeepSeek V4.1-Flash 在性能、费用、速度和任务总用时等指标上已全面超越 V4-Pro。

中信证券认为,国产模型将沿高性价比与前沿智能两条路径继续展开竞争,DeepSeek 深度适配下国产算力基础设施与国产模型同步受益,同时高性价比推理将加速 FDE(前线部署工程师)及企业级 Agent(智能体)落地。

不过,Token 单价下降并不意味着单项任务总成本必然下降。据第三方机构 Artificial Analysis 的评测,在该机构测试中,V4.1-Flash 平均每项任务使用约 8.9 万输出 Token,高于上一代 V4 Flash 0731 的约 6.2 万。该机构评价 V4.1-Flash 的输出非常冗长(very verbose)。

智谱 GLM 5.3 Flash 位居第二,周调用量达 14.1 万亿 Token,环比增长 18%;腾讯混元 Hy4 preview 排名第三,周调用量达 12.5 万亿 Token,环比下滑 26%;DeepSeek-V4-Flash-0731(即 DeepSeek-V4-Flash 正式版)位居第五,周调用量达 9.44 万亿 Token,环比下滑 18%。

免责声明:本文内容与数据仅供参考,不构成投资建议,使用前请核实。据此操作,风险自担。 

每日经济新闻

智客推

智客推

ZAKER 智客推 GEO | AI 时代的品牌认知解决方案

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关标签

ai 腾讯 美国 基础设施 高峰
相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论