伴随着 DeepSeek-V4-Flash 正式版 API 的上线公测,其 API 收费标准也正式尘埃落定——输入最低 1 元 / 百万 tokens、输出 2 元 / 百万 tokens,并且首次引入了 " 峰谷定价 " 机制,在高峰时段价格翻倍;而备受关注的 V4-Pro 正式版收费细则尚未公布,目前仍沿用预览版的永久降价价格。
一、V4-Flash 正式版收费标准:白菜价但分时段
平时价格(非高峰时段):V4-Flash 正式版输入(缓存未命中)为 1 元 / 百万 tokens,输出为 2 元 / 百万 tokens;若缓存命中,输入价格可低至 0.02 元 / 百万 tokens,几乎是免费级别
高峰时段价格翻倍:每日 9:00-12:00 和 14:00-18:00 属于高峰时段,价格翻倍——输入升至 2 元 / 百万 tokens,输出升至 4 元 / 百万 tokens,缓存命中输入则涨至 0.04 元
性价比定位:Flash 版本身就是主打高性价比的轻量模型,输出价格仅为 V4-Pro 预览版(6 元 / 百万 tokens)的三分之一;相比海外顶级模型如 GPT-5.6 Luna 或 Claude Opus 4.8,其成本仅为后者的十分之一甚至更低

二、峰谷定价机制:用价格杠杆分流算力
定价目的:DeepSeek 官方明确表示,引入峰谷定价是为了 " 更合理地配置资源、提升服务稳定性 ",通过价格杠杆将非紧急的批量处理任务引导至非高峰时段,缓解高峰时段的算力压力
价格差异巨大:缓存命中与未命中的价差极富戏剧性——缓存命中输入仅 0.02 元,而缓存未命中输入为 1 元,相差 50 倍;用户可以通过优化 prompt、复用缓存来大幅降低成本
行业影响:这一机制被业内视为 " 粗放调用的时代结束 " 的信号,开发者需要开始做 " 时间管理 ",将非紧急任务安排在晚间或凌晨执行
三、V4-Pro 正式版:收费标准待定,预览版参考价
Pro 正式版未定:截至 7 月 31 日,DeepSeek-V4-Flash 正式版已上线公测,但 V4-Pro 正式版仅表示 " 将尽快发布 ",具体收费方案尚未公布
预览版现行价格:目前可用的 V4-Pro 预览版自 2026 年 6 月起已实施永久降价,输入(缓存命中)0.025 元 / 百万 tokens、输入(缓存未命中)3 元、输出 6 元;若未来正式版峰谷定价生效,高峰时段输出将涨至 12 元
价格预期:业内人士普遍认为,V4-Pro 正式版可能延续低价策略,但会同步引入峰谷定价,且价格相比 Flash 版仍有数倍差距——毕竟 Pro 版本拥有 1.6 万亿总参数,智能上限更高

本文由 AI 生成


登录后才可以发布评论哦
打开小程序可以发布评论哦