潮新闻客户端 记者 张云山
9 月 9 日,DeepSeek 开放平台公告,将于北京时间 2026 年 9 月 10 日 12:00 起,调整 flash 系列定价:空闲时段输入缓存命中单价 0.02 元、输入缓存未命中单价 1 元,输出单价 4 元;高峰时段价格为空闲时段价格的 2 倍。高峰时段是指北京时间周一至周五 9:00-12:00、14:00-18:00(其余为空闲时段)。

调价信息
缓存命中输入降价六成
这次降价,最狠的是 " 缓存命中输入 ",直接砍掉六成,从每百万 tokens 五分钱变成两分钱。其他两项——缓存未命中输入和输出——也降了,分别是 33% 和 11% 左右。
缓存命中翻译成大白话:如果你反复问 AI 同一个问题,或者让 AI 处理大量重复性内容,这部分成本会明显降低。对普通用户来说,感知可能不强,但如果你是个用 API 做应用的开发者,或者公司里经常调用 AI 接口的运营人员,这个变化会实打实反映在月底账单上。
需要注意的是,官方同时明确了两件事:一是高峰期(工作日 9:00-12:00、14:00-18:00)价格翻倍,二是闲时便宜很多。换句话说,DeepSeek 在用价格信号引导用户把不那么急的任务挪到晚上或周末去跑。
算笔账,做一次任务能省多少?
举个最典型的场景——你在闲时调用 AI,消耗 100 万 tokens 的输入(未命中缓存)和 100 万 tokens 的输出。按老价格是 1.5+4.5=6 元,新价格是 1+4=5 元。省了 1 块,约 16.7%。
比例不算夸张,但如果你每天调用量是 " 千万级 " 甚至 " 亿级 " 呢?运营同学应该懂省多少。
真正能省大钱的,是那些缓存命中率高的场景。比如客服机器人回答常见问题、文档总结类任务复用固定提示词、或者长对话中重复使用的系统指令。这些场景下,成本下降会很可观。
DeepSeek 背后打的什么算盘?
从价格策略看,DeepSeek 的思路其实挺清晰的:用低价抢市场。Flash 系列本来就是轻量级模型,价格一直压得很低,这次再降,摆明了是要在性价比这条路上走到底。同时,用价格杠杆调峰填谷。云服务行业玩了很多年的 " 闲时降价 " 策略,现在被复制到了大模型 API 市场。对平台来说,把部分非紧急任务引导到闲时,能更充分地利用算力资源。还在培养开发者习惯。缓存命中降价最多,等于在喊话:好好设计你的调用逻辑,多用缓存,对钱包好。
如果你不是开发者,可能暂时感受不到这份调价通知的分量。但换个角度想:API 降价,意味着用 AI 能力做产品的成本在降低。成本降低,最终会传导到终端产品上——也许过段时间你会发现,某个你常用的 AI 应用变便宜了,或者免费额度变多了。
趋势很明确,大模型调用成本还在往下走。这对整个行业是好事,对普通用户也是好事。
不过官方也提醒了一句:这次是 " 闲时低价 " 策略,着急出结果的任务,该付的钱还是得付。
" 转载请注明出处 "


登录后才可以发布评论哦
打开小程序可以发布评论哦