【CNMO 科技消息】8 月 3 日,海外开发者开源项目团队 OpenCode 发文称,其平台上 DeepSeek V4 Flash 的调用量大幅飙升,单日处理达 8 万亿 Token。其中 5 万亿为免费试用额度消耗,3 万亿为开发者通过 OpenCode 平台付费使用。与此同时,模型 API 分发平台 OpenRouter 的最新数据显示,上周(7 月 27 日至 8 月 2 日)DeepSeek V4 Flash 以 7.22 万亿 Token 的周调用量位居所有模型第一。在全球调用量排名中,前五名均为中国 AI 大模型,DeepSeek-V4-Flash 登顶榜首,环比增长 13%。

DeepSeek
据 CNMO 科技了解,8 万亿 Token 相当于约 5600 万本《三体》三部曲的文字量,或约 4 万部完整电影剧本的体量。以普通用户日常使用场景计算,这一调用量相当于数百万开发者同时高频调用同一模型。
OpenCode 是一个面向程序员的终端 AI 编程工具,其附带的 Zen、OpenCode Go 网关聚焦代码开发场景,基于使用需求精选适配模型。DeepSeek V4 Flash 在代码开发这一垂直场景中单日消耗 8 万亿 Token,意味着其已经成为大量开发者的默认编程助手。
面对 DeepSeek 的强势表现,OpenAI 迅速做出反应。7 月 31 日,OpenAI 宣布 GPT-5.6 Luna 降价 80%,输出价格从每百万 Token 6 美元直接砍到 1.2 美元,输入价格从 1 美元降至 0.2 美元。另一款模型 Terra 也下调了 20%。这一价格调整距离两款模型正式推出仅约三周。
然而,开发者的反应并不如 OpenAI 所愿。在 OpenCode 的评论区,OpenAI 核心产品与平台负责人 Tibo 打起了 GPT-5.6 Luna 的广告,但开发者并未买账。有开发者直言:" 我们希望得到 DeepSeek 的价格。" 这一幕恰恰折射出当前开闭源模型竞争的激烈程度。

OpenAI
即便 OpenAI 将 Luna 价格下调 80%,DeepSeek V4 Flash 在其自有 API 上的单任务成本仍比前者低约 60%。关键原因是 DeepSeek 提供了约 98% 的缓存命中折扣,远超业内普遍的 90%。DeepSeek V4 Flash 的正式版于 7 月 31 日上线公测,正式版在 Agent 能力上大幅增强,定价为同水平模型最低。
中国 AI 大模型已连续十四周在全球调用量排名中领跑。当 OpenAI 以更低价格仍无法在成本与用户心智方面取胜时,国产开源模型正在将传统性价比概念带入全新的竞争阶段。
版权所有,未经许可不得转载


登录后才可以发布评论哦
打开小程序可以发布评论哦