【TechWeb】8 月 4 日消息,7 月 31 日,DeepSeek 正式开放 V4-Flash 正式版 API 公测。短短一周之内,这款国产大模型便在全球 AI 开发者市场掀起了一场风暴。
发布即登顶
根据全球最大模型聚合平台 OpenRouter 的最新数据,上周(7 月 28 日至 8 月 3 日),DeepSeek-V4-Flash 以 7.1 万亿 Token 的周调用量登顶全球大模型调用量榜首。排名第二至第五位均为中国产品:小米 MiMo-V2.5 以 5.4 万亿 Token 位列第二,腾讯 Hy3 以 4.89 万亿 Token 位居第三,DeepSeek-V4-Pro 以 3.1 万亿 Token 排在第四,智谱 GLM-5.2 以 2.87 万亿 Token 位列第五。7 月 31 日最新发布的 DeepSeek-V4-Flash 正式版(DeepSeek-V4-Flash 0731 版)以 2.33 万亿 Token 的调用量强势登上榜单第八。
DeepSeek-V4-Flash 0423 版和 DeepSeek-V4-Flash 0731 版合计调用量断层领先。
仅 8 月 3 日一天,DeepSeek-V4-Flash 0731 版的调用量就达到 1.02 万亿 Token,超过此前霸榜的 DeepSeek-V4-Flash 0423 版。
更令人瞩目的是,OpenCode 平台的数据显示,仅 8 月 1 日一天,DeepSeek V4 Flash 在其平台上的 Token 处理量就达到了 8 万亿,其中 5 万亿为免费试用额度,3 万亿为付费调用。
综合测算,上周全球 AI 大模型总调用量为 56.8 万亿 Token,中国 AI 大模型周调用量达 28.13 万亿 Token,已连续十四周超过美国,稳居全球首位。在全球十大热门模型榜单中,中国模型占据了九个席位。
Agent 能力暴涨、性价比碾压
DeepSeek-V4-Flash 正式版与预览版模型结构、参数规模完全一致,采用 MoE 架构,总参数量 2840 亿,实际激活参数约 130 亿,支持 100 万 Token 上下文窗口。底层基座未做改动,仅完成新一轮后训练优化。
正是这轮 " 后训练 ",带来了 Agent 能力的飞跃。在 Agent 智能体终极测试中,V4-Flash 正式版得分达 25.2 分,接近 Claude Opus-4.8 的 25.7 分,远高于 V4-Pro 预览版的 15.8 分。在 Terminal Bench 2.1 基准测试中,正式版拿下 82.7 分,而预览版仅为 61.8 分。测评机构 Artificial Analysis 的 Intelligence Index 智能指数中,V4 Flash 获得 50 分,比预览版提升 10 分,追平了 Gemini 3.6 Flash。
价格方面,V4-Flash 的竞争力几乎无人能敌。每百万输入 Token 定价 0.14 美元,每百万输出 Token 定价 0.28 美元。美国研究机构 Artificial Analysis 的加权测试显示,V4-Flash 单任务平均成本仅 3 美分,而 Kimi K3 为 86 美分,GPT-5.6 Sol 高达 1.86 美元,Claude Fable 5 更是达到 3.15 美元。其运行成本不到 Anthropic 旗舰模型 Claude Fable 5 的百分之一。换算成人民币,V4-Flash 每百万未命中缓存输入 Token 仅 1 元,输出 Token 2 元,缓存命中输入成本更低至 2 分钱。
有海外开发者反馈,单次任务调用成本甚至低至 0.0005 美元。
海外开发者集体沸腾
DeepSeek V4-Flash 正式版上线后,海外开发者社区的反应堪称热烈。X 平台上,有开发者直言 " 马斯克需要亲自试试 V4 Flash。它就像魔法一样 "。随后,网友发现埃隆 · 马斯克真的关注了 DeepSeek 官方账号。这一细节迅速引爆海外社区讨论,有人调侃 " 下一代编程模型可能会基于 DeepSeek 构建 ",更有网友直接调侃 Grok:" 你的爹要给你买个小弟弟吗?"
玩笑背后是真实的市场转向。据报道,DeepSeek 的访问流量中,美国、欧洲开发者占比接近半数,大量 Agent 自动化项目、代码辅助工具、长文本处理应用主动将默认模型切换至 DeepSeek。多名海外 AI 初创创始人在 X 平台公开复盘,团队全线迁移至 DeepSeek 之后,月度推理成本下降 60% 至 85%。对于尚未盈利、现金流紧绷的小微 AI 公司,这样的成本差异足以决定项目能否继续。
日本科技媒体 Gizmodo Japan 也发文称 V4-Flash 为 " 爆安 Gemini 级 AI",指出其性能与价格 " 完全颠覆 "。研究机构 Artificial Analysis 更直言,DeepSeek-V4-Flash 已成为全球知名模型中运行成本最低的一款。
行业分析认为,DeepSeek 在全球开发者市场划出的是一条清晰的 " 斩杀线 ",不是单纯的性能分水岭,而是性能与价格的平衡临界值:同一能力梯队中,定价显著高于 DeepSeek 的模型将持续流失中小开发者;性能弱于 DeepSeek、成本却更高的产品,生存空间将快速萎缩。很长一段时间,全球大模型市场规则由硅谷巨头书写,OpenAI、Anthropic、谷歌划定性能标尺并牢牢掌控定价话语权。如今,这条 " 斩杀线 " 正由中国 AI 划定。
与此同时,海外闭源头部模型的市场份额持续收缩,Claude 主流版本、Gemini 旗舰模型调用增速持续放缓。OpenAI 也感受到了压力,GPT-5.6 Luna 上线不到三周便宣布价格下调 80%。有分析指出,中国开源模型快速迭代,模型差距不断缩小,价格差距却逐渐拉大,美国头部模型也不得不重新思考性价比。
从 7 月 31 日 API 公测到 8 月 3 日登顶全球调用量榜首,DeepSeek-V4-Flash 仅用了不到一周时间。这款不堆参数、不靠发布会 PPT 的 " 小杯 " 模型,正在用实打实的调用量改写全球 AI 市场的竞争规则。


登录后才可以发布评论哦
打开小程序可以发布评论哦