星途科讯 15小时前
Anthropic确立Fable 5双层访问:Pro用户面临高额按量计费
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_keji1.html

 

促销期结束,Anthropic 并未如最初宣布那样全面开放访问,而是于 7 月 20 日太平洋时间午夜正式对 Claude Fable 5 实施永久性双层级访问结构。根据官方公告,Max 和 Team Premium 订阅者可将 Fable 5 捆绑在计划中,无额外按量计费,但使用量上限为标准周限的 50%。相比之下,Pro 和 Team Standard 订阅者仅获得一次性 100 美元使用额度。额度耗尽后,若需继续使用,必须启用计量计费,费率为每百万输入 token10 美元、每百万输出 token50 美元——这是 Anthropic 针对通用可用模型制定的最高费率。

这 100 美元额度极易耗尽。以每百万输出 token50 美元计算,一次生成 200 万输出 token 的密集编码或文档分析会话(对于 Fable 5 支持的多文件自主工作而言属中等规模)即可用尽全部额度。依赖 Fable 5 进行日常智能体工作的 Pro 订阅者面临二元选择:升级至每月 100 至 200 美元的 Max 计划(Pro 为 20 美元),将密集工作迁移至其他模型,或接受随输出量增加而波动的按量计费成本。

六周三轮延期:Fable 5 的波折历程

Fable 5 于 6 月 9 日发布,作为 Anthropic 首款公开可用的 Mythos 级模型,最初免费包含在 Pro、Max、Team 及部分 Enterprise 订阅中。然而,6 月 12 日美国商务部依据《出口管理条例》发布指令,要求暂停向任何美国以外用户提供 Fable 5 和 Mythos 5 访问权限。因缺乏可靠的实时国籍验证机制,Anthropic 撤回了所有用户对这两款模型的访问。法律分析师指出,此举标志着利用出口管制限制前沿 AI 模型访问的升级。

6 月 30 日,在 Anthropic 训练出针对越狱漏洞的新安全分类器后,商务部解除管制。该漏洞由亚马逊研究人员发现,允许模型识别软件漏洞并生成可利用代码。商务部人工智能标准与创新中心独立测试并批准了更新后的分类器,Fable 5 遂于 7 月 1 日恢复服务。随后,Anthropic 经历了一连串压缩的计费截止日期调整:从原定的 7 月 7 日,因用户反弹延期至 7 月 12 日,后又于 7 月 13 日再次延期至 7 月 19 日,每次调整均通过官方账号发布。

分裂背后:Sol 的竞争压力改写定价逻辑

Anthropic 最初计划促销结束后将所有 Fable 5 费用转为按量计费。然而,Max 用户保留捆绑权益的逆转并非源于容量突破,而是对市场竞争的回应。7 月 9 日,GPT-5.6 Sol 达到通用可用性,其费率为每百万输入 token5 美元、输出 token30 美元——输入成本仅为 Fable 5 的一半,输出费率为 60%。在 Artificial Analysis Intelligence Index 基准测试中,Fable 5 得分约 60 分,Sol 约 59 分,两者在通用能力上处于统计学平局。此外,Sol 完成同等任务的成本约为 Fable 5 的三分之一,因其产生的输出 token 更少。

若 Max 或 Team Premium 订阅不提供旗舰模型访问,而竞争对手以更低费用提供近乎相当的性能,将引发严重的用户留存问题。这一分裂策略将 Fable 5 保留为高收入计划的差异化功能,同时将 Pro 订阅者引导至 Sonnet 5 或升级路径。

Fable 5 的溢价逻辑:架构差异与性能权衡

Fable 5 的定价溢价基于其架构承诺。作为首个面向通用用户的 Mythos 级模型,它采用始终开启的自适应推理,无需显式指令即可在每个请求中参与思维链过程。原始思维链不返回响应,仅可见最终输出。这种架构导致 30 天强制数据保留要求,以便监控跨请求的复杂攻击模式,因此 Opus 4.8 及更早模型提供的零数据保留选项不适用于 Fable 5。

规格方面,Fable 5 拥有 100 万 token 上下文窗口,每次响应最多 128,000 个输出 token。当请求触及网络安全利用、生物化学提升或疑似大规模模型蒸馏时,安全分类器会将约 5% 的会话重定向至 Opus 4.8,并返回 HTTP 200 状态码及拒绝原因,允许开发人员处理回退。

在编码基准测试中,优势取决于任务类型。Fable 5 在 SWE-bench Pro 上得分为 80%,领先于 Sol 的 64.6%,但该数据来自 Anthropic 自身评估,尚未由中立方复现。在 Terminal-Bench 2.1 和 DeepSWE 等智能体及基于终端的编码基准中,Sol 表现更强。对于需要长期一致性和扩展上下文的仓库级工作,Fable 5 具有显著优势;而对于常规智能体循环,Sol 的单任务成本优势明显。

对企业团队而言,Fable 5 采用新分词器,从 Opus 4.7 之前模型迁移提示时,token 数量可能膨胀高达 35%,加剧按 token 成本差异。批量 API 定价将费率减半至输入 5 美元 /M、输出 25 美元 /M,适用于非实时负载。

对各计划层级的实际影响

对于 Max 和 Team Premium 订阅者,此次变更是对现有权益的永久澄清:Fable 5 现为捆绑功能,上限为标准周使用限制的 50%。需注意复合效应:自 5 月 13 日实施的 Claude Code 周速率限制增加 50% 的政策已于今日结束,标准限制首先缩小,随后 50% 的 Fable 上限应用于缩减后的基线,重度用户将感受到使用空间的压缩。

对于 Pro 和 Team Standard 订阅者,变更是结构性的。尽管 Claude Code 首席工程师 Thariq 曾确认 Anthropic 旨在计算容量允许时将 Fable 5 恢复至标准订阅,但未提供时间表。技术现实在于,Fable 5 的自适应推理架构比 Opus 4.8 需要更多每 token 计算量,且 30 天安全保留带来合规开销。在每月 20 美元的 Pro 计划中分摊这些成本,与服务每月 100 至 200 美元的 Max 订阅者相比,经济模型截然不同。截至目前,Anthropic 尚无解决这一基础设施和定价策略问题的时间表。

对于任一计划层级,6 月 30 日发布的 Sonnet 5 作为 Free 和 Pro 计划的新默认值,在智能体任务上提供接近 Opus 4.8 的性能,入门价格直至 2026 年 8 月 31 日为输入 2 美元 /M、输出 10 美元 /M。虽不具备 Fable 5 的百万 token 上下文或 128,000token 最大输出,但对于不需要扩展上下文或多天自主会话的工作流,它是最具成本效益的选择。

Kimi K3:7 月 27 日即将到来的开源变量

下周,成本计算格局将进一步变化。Moonshot AI 的 Kimi K3 已于 7 月 16 日通过 API 发布,计划于 2026 年 7 月 27 日公开发布完整模型权重。Moonshot 称其为全球首个达到 2.8 万亿总参数的开源模型,基于混合专家架构,拥有 896 个专家,每 token 仅激活 16 个。这意味着每次推理的实际计算量约为 500 亿参数,2.8 万亿代表权重存储而非活跃计算。其 Kimi Delta Attention ( KDA ) 架构实现了 100 万 token 上下文窗口,声称解码速度比标准注意力快 6.3 倍。由于权重尚未发布,这些声明尚待独立复现。

7 月 27 日的开源权重发布为开发者提供了在不支付 API 费用的情况下自行托管的选择。但这需要数太字节存储空间和大型多加速器设置,并非消费级 GPU 可承载。Moonshot 已向 vLLM 兼容的 KDA 预填充缓存实现贡献代码,但企业团队需自行配置资源。

IPO 临近下的定价承压

Anthropic 于 2026 年 6 月 1 日向 SEC 提交保密草案 S-1 注册声明,目标是在高盛、摩根大通和摩根士丹利主导下于 2026 年 10 月在纳斯达克上市。其上一次私人估值为 9650 亿美元,设定于 2026 年 5 月 28 日关闭的 650 亿美元 H 轮融资中。随着 IPO 临近,证明 Fable 5 能产生持久的按 token 收入,而非作为促进订阅增长的亏损领导者,对 Anthropic 向公共市场展示商业模式至关重要。

今日的计费变更是该论点的首次具体测试。Max 订阅者以计划价格获得 Fable 5 作为福利,Anthropic 可论证这支持了模型计算开销;超过 100 美元额度的 Pro 订阅者则成为支付最高消费者费率的计量 API 客户。该费率能否抵御 Sol 半价竞争的冲击,以及面对下周即将到达的可自托管替代方案,将在 Anthropic 准备公开亮相的过程中实时经受考验。

【星途科讯 图文丨赵晶 首发于 ZAKER 科技,转载请注明出处】

宙世代

宙世代

ZAKER旗下Web3.0元宇宙平台

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关标签

亚马逊 ai 美国 出口管制 越狱
相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论