《每日经济新闻》根据 OpenRouter 最新数据测算,上周(8 月 3 日至 8 月 9 日)全球 AI 大模型总调用量为 69 万亿 Token,环比增长 21.48%。
其中,上榜的 AI 大模型中,中国 AI 大模型周调用量达 34.25 万亿 Token,环比增长 21.76%;同期美国 AI 大模型周调用量为 9.17 万亿 Token,环比增长 109.36%。中国大模型周调用量连续十五周超过美国,稳居全球首位。


《每日经济新闻》注意到,上周,全球调用量排名前四均为中国 AI 大模型。其中,DeepSeek-V4-Flash-0731(即 DeepSeek-V4-Flash 正式版)位居第一,周调用量达 8.83 万亿 Token,环比增长 570%;腾讯 Hy3 位居第二,周调用量达 8.05 万亿 Token,环比增长 67%;DeepSeek-V4-Flash-0423(即 DeepSeek-V4-Flash 预览版)排名第三,周调用量达 5.88 万亿 Token,环比下滑 19%;小米 MiMo-V2.5 掉到第四,周调用量达 5.39 万亿 Token,环比下滑 14%。
7 月 31 日,DeepSeek 宣布,DeepSeek-V4-Flash 正式版 API 上线公测。据了解,DeepSeek-V4-Flash 正式版的模型结构、尺寸和 DeepSeek-V4-Flash 预览版保持一致,仅重新进行后训练。据官方更新日志显示,V4-Flash 正式版在 Agent 能力上大幅增强,基准测试远超预览版本。
据 Artificial Analysis 测算,V4-Flash 正式版完成单项测试任务的平均成本约为 0.03 美元,只有 Anthropic 旗舰模型 Claude Fable 5 的 1/100,成为目前全球主流模型中成本最低的模型。

OpenAI 旗下 GPT-5.6 Luna 进入前五,周调用量达 4.43 万亿 Token,环比增长 128%。
7 月 10 日,OpenAI 正式公开发布 GPT-5.6 系列模型,而GPT-5.6 Luna 是该系列中速度最快、成本最低的模型,适用于大规模、高频率任务处理,可支持工具调用和多步骤工作流程。该系列模型上线不到三周之际,OpenAI 宣布优化 GPT-5.6 系列模型定价和性能,以提升企业用户 AI 应用的性价比。其中,GPT-5.6 Luna 模型价格下调 80%。
谷歌 Gemini 3.6 Flash 首次进入榜单,排名第九,周调用量达 2.33 万亿 Token,环比增长 446%。
Gemini 3.6 Flash 于 7 月 22 日发布。第三方测评机构 Artificial Analysis Index 的数据显示,Gemini 3.6 Flash 在输出时消耗的 token 数量比上一代 Gemini 3.5 Flash 平均减少了 17%。
其每百万输入 Token 价格保持在 1.50 美元,输出价格则由上一代的 9 美元降至 7.50 美元,降幅约 16.7%。
值得注意的是,此前一周排名第七的 MiniMax M3 和排名第九的阶跃星辰 Step 3.7 Flash 跌出榜单。
免责声明:本文内容与数据仅供参考,不构成投资建议,使用前请核实。据此操作,风险自担。


登录后才可以发布评论哦
打开小程序可以发布评论哦