老斜聊科技 4小时前
DeepSeek涨350%、智谱涨83%:国产大模型为何集体告别低价
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_font3.html

 

8 月 17 日零点,DeepSeek 新版 API 价格正式生效,两款主力模型 V4-Flash 和 V4-Pro 启用 " 峰谷定价 ":每天 9 点到 12 点、14 点到 18 点的高峰时段,价格直接翻倍。更扎眼的是涨幅本身——以 V4-Pro 为例,高峰时段缓存命中输入、缓存未命中输入、输出价格分别上涨了1100%、200% 和 350%,空闲时段也涨了150%、50% 和 125%。那个靠 "Token 价格屠夫 " 名号横扫市场的 DeepSeek,正式加入了涨价阵营。

这股调价风不是一家在刮。过去几年," 便宜 " 几乎是中国大模型唯一的标签,而今年画风彻底变了。

DeepSeek 的峰谷定价,表面是价格策略,本质是对算力供需紧张的一次明码标价。高峰时段对应企业白天集中调用、Agent 工作流密集跑批的真实需求,用价格削峰填谷,既缓解推理侧压力,也把 " 白嫖 " 成本摊回给真正高频使用的客户。

真正让涨价能落地的,是 2026 年智能体(Agent)爆发把 Token 消耗量级彻底拉爆。过去 " 你问我答 " 的聊天模式,单次不过几千 Token;而像 OpenClaw 这类自主 Agent,一个编程任务要经历几十轮 " 写代码—运行—报错—修改 " 循环,活跃会话上下文动辄膨胀到 23 万 Token 以上,单日烧掉上百美元并不罕见。当单次任务消耗从几千涨到几十万,中美模型间的价格差就从 " 可忽略 " 变成了 " 每月数百上千美元 " 的硬成本。算力供需趋紧叠加需求激增,峰谷定价成了顺理成章的削峰填谷工具。

最反直觉的一幕出现了:涨价非但没赶走用户,反而把需求越吊越高。智谱 AI 涨价后调用量增长400%;Kimi K3 高价发布后三天,用户请求量居高不下,只能宣布暂停 C 端新用户订阅。这说明一件事——中国模型的用户,已经不是单纯冲着 " 便宜 " 来的。

背后是能力、价格和开放生态的综合优势在起作用。Kimi K3 凭2.8 万亿参数刷新世界开源模型纪录,腾讯混元、智谱 GLM、MiniMax、小米 Mimo 系列也常年盘踞全球大模型调用量前十。更关键的是开源权重:Hugging Face 最新报告显示,参数超过 200 亿的中国模型中,超八成采用宽松授权协议,允许二次开发和商业部署;基于 Qwen 的衍生模型数量已超30 万个,远超谷歌和 Meta。

分层调用正在成为主流——开发者用 ClawRouter 这类工具把任务按难度分级,简单任务交便宜的中国模型,复杂任务才调高价美国模型,平均成本能从每百万 Token 25 美元降到约 2 美元。能力够用、价格便宜五到十倍,商业决策从来不讲情怀。

中国模型能长期 " 便宜 ",也有结构性原因。一是算力基础设施规模大、复用率高,报价更低;二是 MoE 架构(混合专家)让每次推理只激活一小部分参数,大幅降低计算量。当成本底座压得住,厂商才有底气在能力追平后温和涨价。

底气更有数据撑腰。OpenRouter 最新测算,8 月 10 日至 16 日全球 AI 大模型总调用量75.3 万亿 Token,其中中国模型周调用量36.84 万亿、连续十六周超过美国稳居全球首位;美国同期仅 10.26 万亿。Hugging Face 夏季报告更显示,中国自研开源模型下载占比达41%,首次超过美国,基于 Qwen 的衍生模型超 15 万个。另一条暗线同步推进:阿里刚开源 Qwen3.8-2.4T 旗舰权重,采用 2.4 万亿参数 MoE 架构、每 Token 激活 950 亿参数,同步发布的 27B 模型主打 " 家用显卡也能跑 ",Qwen 系列全球下载量突破 30 亿次登顶;DeepSeek Harness 框架开源,被招商证券国际解读为 "Agent 时代的安卓 "。竞争焦点正从模型能力本身,向框架与生态迁移。

这轮集体涨价,其实是对 2024 年那场价格战的反拨。2024 年 5 月,字节跳动豆包大模型以 0.0008 元 / 千 Token 掀起价格战,阿里、百度迅速跟进,此后近一年行业 Token 价格下降超 90%,部分厂商推理算力毛利率一度为负。当时是用亏损换规模、培养调用习惯;而 2026 年 Agent 需求爆发、算力趋紧后,厂商顺水推舟把价格拉回合理区间——从集体降价到集体涨价,转折只用了不到两年。

面对中国模型的能力逼近和价格上探,大洋彼岸的巨头们选择了相反动作。OpenAI 将 GPT-5.6 Luna 价格下调80%、Terra 下调 20%;Anthropic 推出价格约为先前旗舰一半的 Claude Opus 5,还取消了原定 9 月 1 日生效的 Claude Sonnet 5 涨价计划。摩根士丹利把 DeepSeek 涨价解读为 " 行业定价纪律改善的积极信号 " ——翻译过来就是:价格战打得差不多了,大家都想开始赚钱了。

中国大模型均价已从 2025 年一季度的12.2 元 / 百万 Token回升到 2026 年二季度的21.9 元。这不是尾声,而是分层定价时代的开场:高价值场景凭高性能收溢价,中低端场景继续用性价比抢规模。

DeepSeek 一夜涨 350%、智谱涨 83%,看似是价格的反转,实则是一次定价的自信。当中国模型在性能上追平对手、在开源生态上反超、在调用量上连续十六周领跑,涨价就不再是 " 撑不住 ",而是 " 配得上 "。当然,涨价越多越好是误区,价格仍要与实际价值匹配。真正值得期待的,是有一天中国模型价格不再是全球低位,开发者的答案依然是 " 我愿意 " ——那才是中国 AI 真正的成人礼。

作者声明:作品含 AI 生成内容

宙世代

宙世代

ZAKER旗下Web3.0元宇宙平台

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关标签

高峰 kimi 开源 美国 腾讯
相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论