每日经济新闻 10小时前
中国AI大模型调用量连续十五周领跑:环比增长570%,DeepSeek-V4-Flash正式版登顶
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_caijing1.html

 

原标题:中国 AI 大模型调用量连续十五周领跑:环比增长 570%,DeepSeek-V4-Flash 正式版登顶!MiniMax M3、阶跃星辰 Step 3.7 Flash 跌出榜单

每经记者|宋欣悦 每经编辑|兰素英

《每日经济新闻》根据 OpenRouter 最新数据测算,上周(8 月 3 日至 8 月 9 日)全球 AI 大模型总调用量为 69 万亿 Token,环比增长 21.48%。

其中,上榜的 AI 大模型中,中国 AI 大模型周调用量达 34.25 万亿 Token,环比增长 21.76%;同期美国 AI 大模型周调用量为 9.17 万亿 Token,环比增长 109.36%。中国大模型周调用量连续十五周超过美国,稳居全球首位。

《每日经济新闻》注意到,上周,全球调用量排名前四均为中国 AI 大模型。其中,DeepSeek-V4-Flash-0731(即 DeepSeek-V4-Flash 正式版)位居第一,周调用量达 8.83 万亿 Token,环比增长 570%;腾讯 Hy3 位居第二,周调用量达 8.05 万亿 Token,环比增长 67%;DeepSeek-V4-Flash-0423(即 DeepSeek-V4-Flash 预览版)排名第三,周调用量达 5.88 万亿 Token,环比下滑 19%;小米 MiMo-V2.5 掉到第四,周调用量达 5.39 万亿 Token,环比下滑 14%。

7 月 31 日,DeepSeek 宣布,DeepSeek-V4-Flash 正式版 API 上线公测。据了解,DeepSeek-V4-Flash 正式版的模型结构、尺寸和 DeepSeek-V4-Flash 预览版保持一致,仅重新进行后训练。据官方更新日志显示,V4-Flash 正式版在 Agent 能力上大幅增强,基准测试远超预览版本。

据 Artificial Analysis 测算,V4-Flash 正式版完成单项测试任务的平均成本约为 0.03 美元,只有 Anthropic 旗舰模型 Claude Fable 5 的 1/100,成为目前全球主流模型中成本最低的模型。

OpenAI 旗下 GPT-5.6 Luna 进入前五,周调用量达 4.43 万亿 Token,环比增长 128%。

7 月 10 日,OpenAI 正式公开发布 GPT-5.6 系列模型,而GPT-5.6 Luna 是该系列中速度最快、成本最低的模型,适用于大规模、高频率任务处理,可支持工具调用和多步骤工作流程。该系列模型上线不到三周之际,OpenAI 宣布优化 GPT-5.6 系列模型定价和性能,以提升企业用户 AI 应用的性价比。其中,GPT-5.6 Luna 模型价格下调 80%。

谷歌 Gemini 3.6 Flash 首次进入榜单,排名第九,周调用量达 2.33 万亿 Token,环比增长 446%。

Gemini 3.6 Flash 于 7 月 22 日发布。第三方测评机构 Artificial Analysis Index 的数据显示,Gemini 3.6 Flash 在输出时消耗的 token 数量比上一代 Gemini 3.5 Flash 平均减少了 17%。

其每百万输入 Token 价格保持在 1.50 美元,输出价格则由上一代的 9 美元降至 7.50 美元,降幅约 16.7%。

值得注意的是,此前一周排名第七的 MiniMax M3 和排名第九的阶跃星辰 Step 3.7 Flash 跌出榜单。

宙世代

宙世代

ZAKER旗下Web3.0元宇宙平台

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关标签

ai 美国 腾讯 小米 flash
相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论