本报记者 袁传玺
近期,国产大模型迎来新一轮密集调价。9 月 10 日 12 时起,DeepSeek 下调 Flash 系列模型 API(应用程序编程接口)价格,其中闲时输入(缓存命中)价格由 0.05 元 / 百万词元降至 0.02 元 / 百万词元,降幅达 60%。
" 这一轮调价并非简单的价格竞争,而是大模型从‘卖能力’走向‘卖服务’的必然阶段。" 有行业分析师对《证券日报》记者表示," 国产大模型之间的竞争已进入新阶段,行业的竞争逻辑正从‘拼价格’悄然转向‘拼生态’。"
国产大模型调价并非单一走势。智能体应用快速增长带来算力压力,长上下文请求高度依赖缓存,大幅推高推理成本,部分厂商率先提价以覆盖成本。8 月,智谱 GLM Coding Plan 新版订阅套餐 Lite、Pro、Max 月费分别为 118 元、538 元和 1078 元,此前为 49 元、149 元、469 元,三档分别上涨约 141%、261% 和 130%。
与此同时,低价替代方案迅速跟进。8 月 26 日,智谱开源 GLM-5.3-Flash,定价仅为旗舰版的十分之一;同日,阿里开源 Qwen3.8-Flash,官方称价格最低可至 DeepSeek V4 Flash 的三分之一。
当前,国产大模型 API 价格已呈明显的 " 梯队分化 "。从 9 月各家官网定价看,经济型模型的输入价格普遍降至 1 元 / 百万词元左右;旗舰模型之间价差则显著拉大,Kimi K3 输入、输出价格高达 20 元 / 百万词元、100 元 / 百万词元,而 MiniMax M3 在 " 永久五折 " 后仅为 2.1 元 / 百万词元、8.4 元 / 百万词元。有测算显示,同样一项典型任务,选用不同模型的成本差距接近 60 倍。
" 看似矛盾的涨价与降价,实则是同一本账的两面:提价端以峰谷定价引导批量任务向低谷时段转移,摊薄单位算力成本;降价端则以贴近边际成本的价格抢占词元入口。" 广州艾媒数聚信息咨询股份有限公司 CEO 张毅表示,降价有利于扩大智能体和推理调用量,但单位词元收入下降,云厂商需要依靠调用量增长和推理效率提升来维持算力回报。这也意味着,单纯降价换市场的空间正在收窄,竞争必须寻找新的支点。
从以价换量到生态筑墙
需求端的放量,是此轮调价的底层动因。中国电信研究院近日发布的《智能体时代 AI 基础设施发展研究报告(2026)》预计,2026 年我国词元年消耗量将达 10 亿亿。智谱、MiniMax 等厂商的财报亦显示,开放平台和 API 业务已成为主要增长来源——以低价开源抢占词元入口,正是各家的共同布局。
不过,单价降至 " 分币级 ",并不意味着开发者和企业用户会单纯为低价买单。有软件开发企业负责人对《证券日报》记者表示,模型调用只是成本的一部分,若模型输出不稳定、需要反复调整和重复调用,综合成本未必划算,企业真正需要衡量的是 " 成功成本 " 与总拥有成本。但当旗舰模型的能力差距收窄到用户难以感知时,决定开发者去留的就不再是价目表上的数字,而是迁移成本。
" 头部模型的用户可感知差距已经很小,比拼的是能力、成本与国产化适配的综合实力。" 上述行业分析师认为,定价权来自推理成本控制和生态黏性,行业正从 " 稀缺溢价 " 走向 " 效率竞争 "。原厂提价是对自家端点定价权的维护,托管商让利则是边际成本的竞争。
头部厂商已在为低价竞争之后的阶段布局。智谱构建 " 基础模型 + 编程工具 + 订阅服务 " 的生态组合,将模型深度嵌入开发工作流,以提高用户迁移成本;月之暗面则为 Kimi K3 量身定制开源许可条款,对通过 MaaS 服务第三方且连续 12 个月收入超过 2000 万美元的企业要求另行签署商业协议,试图将护城河 " 从权重挪到托管效率 ";DeepSeek 则以 V4.1 Flash 承接旗舰流量,探索 " 降本 " 与 " 稳价 " 之间的平衡。
事实上,三条路径打法各异,指向却一致:把一次性的模型买卖,变成对开发者工作流的长期绑定。正如综合开发研究院近日发表的观点,词元经济的上半场看产能、价格和调用规模,下半场则看 " 谁能用更少的词元,完成更复杂的任务 "。当词元本身趋于同质,承载词元的平台、工具与服务,才是差异化竞争的真正战场。
从 " 拼参数 " 到 " 拼价格 ",再到 " 拼生态 ",密集调价正在加速行业格局重塑。张毅认为,能够在推理成本、服务稳定性与生态黏性之间找到平衡的厂商,才能在下一阶段占据主动。价格可以持续下探,但商业模式的护城河,终究要靠生态来构筑。


登录后才可以发布评论哦
打开小程序可以发布评论哦