机器之心Pro 3小时前
刚刚,OpenAI宣布GPT-6提速50%,额度却被锤只有Claude的1/5
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_keji1.html

 

编辑|Panda

昨天,Tibo 承诺「连续 28 天发布或重置」。刚刚,首个更新来了。

Tibo 宣布,OpenAI 已优化默认速度:订阅用户在所有产品中使用 GPT-6 Astra 和 GPT-6.1 Sol,速度提升约 50%。用户无需做任何操作,两小时内就能感受到变化。

同时,OpenAI 官方还宣布了文本水印功能:

而就在几乎同一时间,SemiAnalysis 发布了一份订阅实测报告,标题毫不客气:Anthropic 订阅提供的价值是 OpenAI 的 5 倍以上。

https://newsletter.semianalysis.com/p/anthropic-subscriptions-offer-5x

OpenAI 可能也没想到,自己刚兑现承诺就被 SemiAnalysis 这家著名第三方机构正面打脸。不仅如此,就连 OpenAI 这次更新本身,也被很多网友吐槽力度不够,不如一次重置。

昨天我们写到,开发者日之后,OpenAI 正面临一场用户信任危机,重度用户的不满集中在两件事上:模型慢,额度少。第 1 天回应了前者,SemiAnalysis 的报告则把后者摆上了台面。

第 1 天:先解决「慢」

这次提速不只覆盖 OpenAI 自家产品,也包括所有通过「Sign in with ChatGPT」接入的合作伙伴,Tibo 点名了 OpenCode、Pi、Amp、Devin 等。换句话说,只要是用 ChatGPT 订阅跑这两个模型,无论在哪里调用,都会变快。

但有开发者在评论区表示,即便如此,ChatGPT 模型依然比 Claude 慢。

还有一些开发者则在评论区表示了质疑,并有一些实测结果晒出,比如 @BrenBuilds 晒出的实测数据显示,GPT-6.1 的速度不过是回到了该模型发布当前的速度。

同样花钱,差了 5 倍

但速度不等于额度。第 1 天的更新没有提到任何使用限额的变化,而这正是 SemiAnalysis 报告的主角。

这份报告对 Anthropic、OpenAI、Meta、SpaceXAI、MiniMax、月之暗面(Moonshot)、智谱(Z.ai)、Cursor 和 Cognition 的订阅方案逐一做了极限测试。

订阅方案不会公开细粒度的价格,用户只能看到一个 0 到 100% 的用量进度条,通常分为 5 小时和 7 天两个窗口。

SemiAnalysis 的做法是把输入、缓存写入、缓存读取、输出四类 token 逐一隔离,用专门设计的 prompt 反复调用,记录进度条每跳一格消耗了多少 token,直到误差收敛到 ± 5% 以内。最后再按 API 价格折算,得到每份订阅的「API 等价价值」,也就是这份额度如果按 API 计费值多少钱。

SemiAnalysis 发现,同一家厂商的三个相同订阅里,有一个账号的额度比另外两个低约 20%。与厂商沟通后才确认,这个账号被分进了一个规模极小的额度 A/B 测试。这也说明,厂商可以随时、静默地调整订阅额度,普通用户几乎无从察觉。

先看旗舰档。GPT-6 Astra 和 Claude Fable 5.1 的额度其实相当接近,区别在于 Fable 在 Claude 订阅中最多只能占用总额度的一半。在 200 美元档位上,用掉价值 2485 美元的 Fable 5.1 之后,Claude 订阅还剩一半额度可以留给其他模型;同档 OpenAI 订阅在消耗完价值 2897 美元的 Astra 后,就彻底见底了。

真正拉开差距的是中档模型,也就是两家都定位为大多数用户「日常主力」的 Claude Opus 5.5 和 GPT-6.1 Sol。在这一层级,Anthropic 订阅的 API 等价价值约为 OpenAI 的 5 倍,并且在各个价位档全面领先。

有人会说,这样比对 OpenAI 不公平:6.1 Sol 的 API 单价本就比 Opus 5.5 便宜得多,按 API 价格折算自然吃亏。SemiAnalysis 预判了这个质疑,即便改为直接比较 token 数量,差距依然很大。

OpenAI 能拿出来的唯一反驳,是它的 Pro 套餐没有 5 小时限制,用户更容易把月度额度真正用满。但 SemiAnalysis 认为,这不足以抵消 Opus 5.5 在 Claude 订阅上约 4 倍的价值优势。

报告判断:独立开发者过去常常称赞 OpenAI 的订阅额度比 Anthropic 慷慨,这个说法如今已经不成立了。

额度砍半,500 美元档只多 21%

差距之所以这么大,很大程度上来自 OpenAI 上周的那次调整,参阅《OpenAI 将重新开放 200 美元套餐,但 Tibo 被骂惨了》。

SemiAnalysis 的追踪数据证实了 Tibo 此前宣布的变化:OpenAI 200 美元套餐的 API 等价价值被砍掉一半。具体来说,每个模型档位可用的 token 数量都减半;又因为 GPT-6.1 Sol 同时下调了缓存输入价格,Sol 级模型的 API 等价价值跌幅超过 50%。降额前购买的 200 美元套餐可以保留旧额度到 10 月 29 日,新购用户则立即适用新额度。

同期推出的 500 美元新档位,Astra 额度只比旧版 200 美元套餐多 21%,Sol 级模型的 API 等价价值甚至不升反降。这一档真正的卖点是   300 TPS   的 Ultrafast 模式,SemiAnalysis 表示其额度仍在测试中。

在此之前,200 美元档是 OpenAI 补贴力度最大的套餐。按每美元价值计算,Pro 100 在 Astra 上约为 Plus 的 2 倍,Pro 200 又在 Pro 100 的基础上再翻一倍。调整之后,Pro 100、200 和 500 三档每美元能换到的 token 完全一致,「买大档更划算」的逻辑不复存在。

很多用户的抱怨「付的钱没少,用量变少了」,现在有了第三方数据作注脚。当然,这个第三方数据本身也受到了一些质疑:

两种降补贴思路

为什么要收紧订阅?SemiAnalysis 算了一笔账。订阅是高度补贴的产品,以 Anthropic 为例,据估算,订阅只占总收入的约 10%,却可能吃掉 40% 以上的推理算力,让每兆瓦的混合收入减少约 3600 万美元。

对订阅收入占比更高的 OpenAI 来说,这个问题只会更突出。

两家都想降低补贴,路径却截然不同。

Anthropic 走的是渐进路线:越高端的模型,订阅里给的 API 等价价值越低。Sonnet 5.5 与 Opus 5.5 之间差距不大,到了 Fable 5.1 则明显收缩。SemiAnalysis 测算,在 100% 使用率、API 毛利率 92% 的假设下,用满 Opus 5.5 对应的订阅毛利率是 -369%,用满 Fable 5.1 约为 1%;如果按更现实的 20% 平均使用率计算,两者分别为 6% 和 80%。换句话说,如果所有人只用 Fable,Anthropic 的订阅业务很可能已经拥有软件公司级别的利润率。

OpenAI 选的则是被 SemiAnalysis 称为「核选项(nuclear option)」的做法:直接把所有模型的额度一刀切,降到 Fable 级别。

按理说,这种做法应该招致强烈反弹。但 SemiAnalysis 认为,OpenAI 在很大程度上躲过了这一劫,可能的原因是开发者日的大量正面宣传冲淡了前一天的降额消息,加上老用户还能多保留一个月旧额度。

只是从这几天社交媒体上的情绪来看,这次「躲过」也许只是推迟。

剩下的 27 天

第 1 天的提速是实打实的改进。Tibo 也给出了 OpenAI 自己的辩护逻辑:模型完成任务需要的 token 更少,单比 token 数量或 API 等价价值,并不能完全反映实际产出。这个论点有一定道理,SemiAnalysis 自己也承认,当某个模型按 API 价格看特别贵或特别便宜时,API 等价价值会失真。

但「每个任务能省多少 token」目前还没有第三方的量化数据,而额度减半已经是被测出来的事实。

还有一个时间点需要留意:降额前购买的 200 美元套餐,旧额度将在   10 月 29 日到期,正好落在这 28 天的窗口期内。到那时,此前被「保护」起来的一批重度用户,也会直接感受到额度的变化。

https://help.openai.com/zh-hans-cn/articles/9793128-about-chatgpt-pro-tiers

订阅额度之争从来不只是成本问题,也是一场用户争夺战。SemiAnalysis 在报告开头提到,OpenAI 此前几次慷慨的额度重置,是 Codex 近期用户激增的重要原因之一,Anthropic 也因此多次收回原定的订阅降额计划。

如今,情况已然开始变化。

智客推

智客推

ZAKER 智客推 GEO | AI 时代的品牌认知解决方案

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论