8 月 6 日,DeepSeek 开放平台弹出提示,宣布计划近期整体上调 DeepSeek API 服务定价,预计涨幅较大。该通知引发 AI 从业者广泛关注。DeepSeek 此前以低价策略著称,近三个月内已多次调整定价机制:5 月延续 DeepSeek V4-Pro 模型 2.5 折优惠;6 月预告 V4 正式版上线并推出 API 峰谷定价方案,高峰时段(每日 9 — 12 时、14 — 18 时)调用价格翻倍。
目前 DeepSeek API 仅支持 DeepSeek V4-Flash 模型,暂不支持 DeepSeek V4-Pro 模型。二者均为 DeepSeek V4 预览版本,于 4 月上线并同步开源。DeepSeek V4-Pro 参数量为 1.6T,DeepSeek V4-Flash 为 284B。DeepSeek V4 具备百万字超长上下文能力,在 Agent 能力、世界知识和推理性能方面处于国内及开源领域领先水平。Agentic Coding 评测显示,DeepSeek V4-Pro 当时已达开源模型最佳水平,在多项 Agent 相关评测中表现优异;4 月起成为 DeepSeek 内部员工使用的 Agentic Coding 模型,使用体验优于 Sonnet 4.5,交付质量接近 Opus 4.6 非思考模式,但与 Opus 4.6 思考模式仍存差距。
当前 DeepSeek V4-Flash 模型百万 Tokens 输入(缓存命中)价格为 0.02 元,缓存未命中为 1 元,输出为 2 元;DeepSeek V4-Pro 模型对应价格分别为 0.025 元、3 元和 6 元。即 V4-Flash 在缓存未命中和输出环节价格均为 V4-Pro 的三分之一,且其输入(缓存未命中)价格仅为后者的 80%。根据通知,V4-Flash 正式版 API 已于 8 月初上线公测,Agent 能力显著增强;DeepSeek API 亦将于 8 月初支持 V4-Pro 模型。
对比国产大模型定价,GLM-5.2 百万 Tokens 输入单价为 8 元、输出为 28 元,缓存命中价为 2 元;MiniMax M3(上下文 512K — 1M 标准版)输入为 4.2 元、输出为 16.8 元、缓存读取为 0.84 元。而 GPT-5.6 Luna 于 7 月底降价 80%,调整后输入为 0.2 美元、输出为 1.2 美元。文渊智库创始人王超推测,此次 DeepSeek 涨价或将成倍上涨,或至少与当前国产大模型主流价格持平,原因在于此前 " 价格黑洞 " 导致高性价比吸引大量用户运行高资源消耗应用,超出其推理承载能力。
王超指出,若算力不足导致用户体验下降,将影响接入 DeepSeek API 的云厂商收入,不利于生态扩展;同时,DeepSeek 当前定价偏低,付费用户多将其作为生产力工具,对价格敏感度较低。类似压力已见于行业其他厂商,如 Kimi 于 7 月上旬因 K3 发布后算力超载,暂停 C 端新用户订阅,优先保障存量用户。
长期来看,智源研究院院长王仲远认为 Token 成本存在下行趋势,依据包括算力提升、工程与算法优化、任务分级细化及芯片能力进步;涂鸦智能联合创始人杨懿强调 Token 成本取决于使用效率;Kimi 创始人杨植麟提出 " 生产力即 Agent,Agent 产生 Token,Token 在一定程度上等价于 GDP";百度创始人李彦宏则主张以 " 日活智能体数 "(DAA)替代 Token 作为 AI 时代核心度量衡,因其反映产出而非仅投入成本。
免责声明:本文内容由开放的智能模型自动生成,仅供参考。


登录后才可以发布评论哦
打开小程序可以发布评论哦