OpenAI、Anthropic 等美国头部 AI 实验室,自 7 月下旬以来正大幅降价中端 AI 模型,力求留住价格敏感客户;这些客户正转向中国的低价模型产品。
近期,Anthropic、OpenAI 将部分企业客户从固定订阅模式切换为按使用量计费,企业按照实际消耗算力付费,企业 AI 用户成本压力随之加大。
AI 使用成本持续走高,部分企业为应对账单上涨,对 AI 调用设置上限,或是测试价格更低的替代方案。
在此背景下,月之暗面(Kimi ) 、深度求索 ( Deepseek ) 等中国 AI 开发企业,从美国硅谷到欧洲,不断获取新的客户。
美国外卖平台 DoorDash、民宿平台爱彼迎 (Airbnb)等企业表示,他们已经开始使用中国模型来控制 AI 开支。
中国 AI 实验室近期密集发布新模型,不断缩小与美国顶尖模型的性能差距。美国科技行业有点担忧:即便美国企业投入巨额资金维持技术优势,仍有可能流失客户。
业内指出,OpenAI 和 Anthropic 此次降价,标志着美国闭源 AI 企业竞争逻辑发生转变:此前这类企业主要比拼模型性能,如今也不得不将价格纳入核心竞争维度。
AI 数据研究机构 Silicon Data 发布的 token 价格指数显示,受 AI 实验室主动下调模型报价影响,自 7 月中旬以来的近一个月内,客户采购美国头部实验室模型的实际支出已下降近四分之一。
降价后成本到底如何?
美国 AI 实验室本轮降价主要针对中端模型,以此对标中国竞品。
OpenAI 于当地时间 7 月 30 日宣布将 GPT-5.6 Luna 输入 token 价格由每百万 1 美元下调 80% 至 0.20 美元;输出 token 由每百万 token6 美元下调至 1.20 美元。
Anthropic 于 7 月下旬上线 Opus5,定价为每百万输入 token5 美元、每百万输出 token25 美元,仅为自家 Fable5 模型的一半。本周 Anthropic 取消原定于 9 月生效的 Sonnet5 涨价计划。
输入 token 是指用户发给 AI 的内容,输出 token 是 AI 返回的回答,二者往往分开计费。
然而,业内指出,仅依据公开 token 报价,无法直接横向对比不同 AI 模型的真实使用成本。
一方面,高性能模型完成相同任务,消耗的 token 更少、重试次数也更少,即便 token 标价偏高,实际完成任务的总花费可能更低。另一方面,绝大多数模型提供可调节的 " 算力档位 ",档位越高调用算力越多,既会改变模型输出效果,也直接影响最终开销。
AI 评测机构 ArtificialAnalysis 近日从数学、科学、代码、推理等维度开展模型基准测试发现:
Anthropic 的 Opus5 在中等算力档位下,任务性能、单任务成本,与月之暗面 Kimi K3 最高算力档位水平相当;
OpenAI 的 GPT-5.6Luna 开启最高算力档位,性能与深度求索 V4 Flash 最高算力档位接近,但单任务成本约为后者的两倍。


登录后才可以发布评论哦
打开小程序可以发布评论哦