AI寒武纪 19小时前
同样花200美金,Claude给的算力是ChatGPT的5倍,知名机构把各大模型底裤扒光了
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_font3.html

 

知名分析机构 SemiAnalysis 最新实测曝光,花同样的钱买 AI 订阅,Anthropic 给你的 Token 实际价值是 OpenAI 的 5 倍以上。

很多人不知道,现在各家大模型的会员订阅,本质上全靠厂商亏本补贴。

在 Anthropic 的账本里,订阅用户只贡献了 10% 的收入,却吃掉了整整 41.7% 的推理算力。

这直接把每兆瓦算力的综合收入拉低了 3600 万美元。

如果一个用户把 Claude 200 美元套餐里的 Opus 5.5 额度彻底打满,Anthropic 在这笔订单上的毛利率是负 369%。

为了弄清楚各大厂商到底补贴了多少,SemiAnalysis 对 Anthropic、OpenAI、Meta、MiniMax、月之暗面、智谱等主流厂商的订阅套餐做了一次彻底的极限压力测试。

测试结果直接揭开了 AI 厂商在用量限制上的所有秘密。

OpenAI 连夜大砍额度,Anthropic 全面碾压

上个月底,OpenAI 对订阅体系做了一次大手术。

他们直接把 200 美元 ChatGPT Pro 套餐的 Token 额度砍掉了一半,同时上线了更贵的 500 美元档位。

降价与砍额度之后,OpenAI 和 Anthropic 的差距彻底被拉开了。

先看两家最顶级的旗舰模型对比:GPT-6 Astra 对决 Claude Fable 5.1。

在 200 美元月费下,ChatGPT Pro 200 可以跑出价值 2897 美元的 API 等价 Token。

Claude Max 20x 跑出 2485 美元。

表面看两者差不多,但 Anthropic 规定 Fable 5.1 最多只能消耗总额度的 50%。

这意味着你把 2485 美元的 Fable 额度用光后,账户里还剩一半额度可以继续跑其他模型。

而 OpenAI 跑到 2897 美元时,整个账户就已经彻底见底。

真正的差距出现在中端主力模型上,也就是日常编程和生产力最常用的 Opus 5.5 对决 GPT-6.1 Sol。

在 200 美元月费下:

Claude Max 20x 可以跑出 286 亿个 Token,折合 API 价值 11726 美元,达到了月费的 58.6 倍。

ChatGPT Pro 200 只能跑出 102 亿个 Token,折合 API 价值 2084 美元,只有月费的 10.4 倍。

在 100 美元月费下:

Claude Max 5x 能跑出 140 亿个 Token,API 价值 5725 美元。

ChatGPT Pro 100 只能跑出 51 亿个 Token,API 价值 1055 美元。

在 20 美元入门档位下:

Claude Pro 能跑 29 亿个 Token,价值 1178 美元。

ChatGPT Plus 只能跑 10 亿个 Token,价值 211 美元。

无论在哪一个价位段,Anthropic 给用户的实际 API 等价价值都是 OpenAI 的 5 倍左右,Token 总量也达到了接近 3 倍。

独立开发者圈子里一直流传着 OpenAI 比 Anthropic 大方的说法。

实测数据证明,这个说法已经成为过去式了。

怎么测出厂商隐藏限制的?

订阅套餐的界面上通常只有一个 0% 到 100% 的用量进度条,并不会告诉你到底消耗了多少 Token。

为了把用量百分比换算成真实的 Token 数量和美元价值,测试团队设计了一套极其严密的逆向工程方案。

他们把 Token 拆分成四种类型分别测试:未缓存输入、缓存写入、缓存读取、生成输出。

为了测输入和缓存,测试人员调用了《战争与和平》的文本。

普通输入测试每次带上随机标记,防止被系统缓存。

缓存写入测试每次强制创建新缓存。

缓存读取测试则固定标记,反复读取同一段已经缓存好的文本。

为了测输出 Token,测试人员使用长篇技术论文提示词,强制模型生成超长回复。

每次调用后,记录系统消耗的 Token 数和进度条移动的百分比。

由于进度条不是平滑移动,而是按固定步长跳动,测试人员通过累计多次请求,计算出进度条跳动一个刻度所需的 Token 数量,把误差严格控制在 5% 以内。

在测试过程中,团队甚至意外抓到了厂商的灰度测试。

三个完全相同的账号,其中一个老账号的额度比另外两个低了 20%。

联系厂商后对方承认,他们确实在极小范围内通过 A/B 测试悄悄调整用量上限。

这也证明了一件事:AI 厂商随时都在后台悄悄修改你的订阅额度。

面对巨额亏损,两家巨头走向了两个极端

订阅用户用得越多,厂商亏得越惨。

面对这块失血严重的业务,OpenAI 和 Anthropic 选择了完全不同的应对策略。

Anthropic 选择温水煮青蛙。

他们保持低阶和中阶模型的超高额度,但对最新最贵的旗舰模型严加限制。

Sonnet 5.5 和 Opus 5.5 依然保持近 60 倍的高价值倍数,而最贵的 Fable 5.1 价值倍数立刻骤降到 12 倍,并且锁死在 50% 用量上限。

只要用户主要使用 Fable 这种高阶模型,Anthropic 就能把订阅毛利率拉回到 80% 的正常软件水平。

OpenAI 则选择了直接掀桌子。

他们没有精细化区分模型,而是直接把 200 美元套餐的所有模型 Token 额度一刀切砍掉 50%。

以前花 200 美元买 Pro 套餐,每 1 美元能买到的 Token 数量是 100 美元档位的两倍。

现在经过调整,100 美元、200 美元、500 美元三个档位,每 1 美元买到的 Token 数量已经完全没有任何区别。

新推出的 500 美元套餐,能够消耗的 Astra 模型 Token 只比老款 200 美元套餐多了 21%,主要的卖点只剩下了每秒 300 Token 的超高速推理。

国产大模型表现如何?

在算力相对紧张的背景下,国内厂商的编程订阅套餐同样给出了不错的补贴力度。

整体来看,国产订阅套餐呈现出一个规律:买的套餐越贵,每 1 美元换来的 Token 价值越高。

MiniMax 的 Token Ultra 套餐售价 132 美元,能跑出价值 3088 美元的 API 等价 Token,价值倍数达到 23.4 倍。

智谱的 GLM Coding Max 售价 168 美元,能跑出 1942 美元的 API 价值,倍数为 11.6 倍。

月之暗面的 Kimi Code Ultra 售价 199 美元,能跑出 1343 美元的 API 价值,倍数为 6.7 倍。

在每 1 美元换取的实际价值上,MiniMax 的高阶套餐表现突出,甚至超过了 OpenAI 的 GPT-6 Astra,紧跟在 Claude 主力模型之后。

综合全网所有测试数据,如果你追求极致的性价比和单次订阅能拿到的最大算力池,目前 Anthropic 的第一方订阅依然是断层领先的选择。

当然了以上分析只是一家之言,仅供参考

详细信息在这 source:

https://newsletter.semianalysis.com/p/anthropic-subscriptions-offer-5x

最后记得⭐️我,每天都在更新:如果觉得文章还不错的话可以点赞转发推荐评论

智客推

智客推

ZAKER 智客推 GEO | AI 时代的品牌认知解决方案

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论