快科技 8 月 4 日消息,DeepSeek V4 Flash 不是当前最强的大模型,但绝对是国内外最火的,0731 正式版升级之后性能更是猛增,这几天用量已经爆了,甚至开始出现服务掉线。
OpenCode 日前宣称,DeepSeek V4 Flash 在 8 月 1 日那一天就曝出了 8 万亿 Token 的用量,但这可不是他们的全部,实际上 4 月份预览版发布之后,DeepSeek V4 Flash 就一直是他们用量较大的主力模型之一。
仅仅是 6 月 10 日到现在的 8 月 4 日,DeepSeek V4 Flash 在 OpenCode 上的总用量就达到了 90 万亿 Token,但这么恐怖的用量并没有花多少成本,因为它实在太便宜了,成本才 92 万美元,1 亿 Token 综合下来只要 1.02 美元。

在 API 收费上,OpenAI 及 Anthropic 的标准都是 DeepSeek V4 Flash 的几十倍,Fable 5 这种级别的大模型费用甚至要 100 倍以上,OpenCode 上的用户要是用这两家的大模型搞开发,那成本涨个 30-50 倍是正常的。
DeepSeek V4 Flash 最近几天实在是太火了,用量大到官方服务器已经撑不住了,这两天有网友就发现会出现 503 报错了,提示服务器过于繁忙。
这个时候 DeepSeek 官方也没办法了,甚至建议用户去使用别家的大模型,切换到其他大模型服务商。
只不过用户恐怕是愿意切换的,因为其他家大模型价格贵不少不说,性能打得过 0731 正式版的也没几个。

就算是其他服务商也部署了 DeepSeek V4 Flash 0731 正式版,但 API 收费也做不到 DeepSeek 这么便宜,国内的其他几家大模型平台缓存命中费用是官方定价的 10 倍,而 V4 Flash 的缓存命中率超高,经常在 90% 以上,意味着换了平台成本也会大增。
联想到此前爆出的梁文锋投资会议上的演讲中提到的一件事,他表示团队并没有在 C 端花太多力气去获客或刻意维护,但用户却 " 赶都赶不走 ",表现出极强的认可度与留存率——现在能理解了吧,DeepSeek 在低成本上是有技术的,其他家不一定能做到。



登录后才可以发布评论哦
打开小程序可以发布评论哦