全天候科技 2小时前
Deepseek官宣降价!缓存命中单价0.02元、未命中1元,价差50倍
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_keji1.html

 

DeepSeek 再度调整 API 定价策略,这次并非简单的全面降价,而是将降价重点放在 " 缓存命中 " 上,同时引入高峰、空闲时段差异化计费,进一步瞄准高频调用和长上下文场景。

根据 DeepSeek 开放平台公告,Flash 系列将于北京时间 2026 年 9 月 10 日 12:00 起实施新定价。空闲时段输入缓存命中单价降至 0.02 元 / 千 token,缓存未命中单价为 1 元,二者价差达到 50 倍;输出单价为 4 元。高峰时段(北京时间周一至周五 9:00-12:00、14:00-18:00)各项价格均为闲时的 2 倍。

这意味着,对于能够反复复用相同上下文的应用,API 成本可能出现明显下降。简单来说,所谓 " 缓存命中 ",就是模型此前已经处理过的一部分内容,在后续请求中无需重新完整计算,系统可以直接复用相关结果。对于长提示词、固定系统指令或持续对话等场景,这部分内容往往占据输入 token 的大头,因此缓存命中率越高,降本效果越明显。

新定价结构:让价格跟着使用方式走

此次调整最明显的变化,是 API 价格不再只由调用量决定,而是与调用时间和内容是否重复同时挂钩。

对于开发者而言,这意味着同样调用 100 万 token,如果大部分内容能够被缓存,成本可能远低于每次都重新输入。尤其是 RAG、代码助手、客服机器人、Agent 等应用,往往存在大量重复的系统指令、知识库和历史上下文,更容易从这一机制中受益。

这也会改变开发者的成本优化方式。过去主要是选择更便宜的模型、减少 token 消耗;现在则可以进一步通过固定上下文、拆分动态内容等方式提高缓存命中率。换言之,API 成本管理开始从 " 少用 token" 延伸到 " 让 token 尽可能复用 "。

降价背后:既抢用户,也调算力

从平台角度看,缓存和时段优惠并不只是给用户 " 打折 ",背后还有明显的算力调度逻辑。

缓存命中意味着部分输入无需重复计算,可以降低相同请求反复处理带来的算力消耗;而闲时折扣则是在价格层面鼓励用户错峰,把部分非实时任务从工作日高峰转移出去。两者结合,本质上都是在提高有限算力资源的利用效率。

对于 DeepSeek 而言,这种模式还有另一层意义:它重点优惠的是能够形成稳定、高频调用的用户,而不是无差别降低所有请求的价格。RAG、代码助手、客服和 Agent 等应用一旦建立在 API 之上,迁移成本通常也会随着调用量和业务深度增加,因此这类用户的长期价值更高。

宙世代

宙世代

ZAKER旗下Web3.0元宇宙平台

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关标签

命中率 机器人 flash 高峰 效果
相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论