
这 100 美元额度极易耗尽。以每百万输出 token50 美元计算,一次生成 200 万输出 token 的密集编码或文档分析会话(对于 Fable 5 支持的多文件自主工作而言属中等规模)即可用尽全部额度。依赖 Fable 5 进行日常智能体工作的 Pro 订阅者面临二元选择:升级至每月 100 至 200 美元的 Max 计划(Pro 为 20 美元),将密集工作迁移至其他模型,或接受随输出量增加而波动的按量计费成本。
六周三轮延期:Fable 5 的波折历程
Fable 5 于 6 月 9 日发布,作为 Anthropic 首款公开可用的 Mythos 级模型,最初免费包含在 Pro、Max、Team 及部分 Enterprise 订阅中。然而,6 月 12 日美国商务部依据《出口管理条例》发布指令,要求暂停向任何美国以外用户提供 Fable 5 和 Mythos 5 访问权限。因缺乏可靠的实时国籍验证机制,Anthropic 撤回了所有用户对这两款模型的访问。法律分析师指出,此举标志着利用出口管制限制前沿 AI 模型访问的升级。
6 月 30 日,在 Anthropic 训练出针对越狱漏洞的新安全分类器后,商务部解除管制。该漏洞由亚马逊研究人员发现,允许模型识别软件漏洞并生成可利用代码。商务部人工智能标准与创新中心独立测试并批准了更新后的分类器,Fable 5 遂于 7 月 1 日恢复服务。随后,Anthropic 经历了一连串压缩的计费截止日期调整:从原定的 7 月 7 日,因用户反弹延期至 7 月 12 日,后又于 7 月 13 日再次延期至 7 月 19 日,每次调整均通过官方账号发布。
分裂背后:Sol 的竞争压力改写定价逻辑
Anthropic 最初计划促销结束后将所有 Fable 5 费用转为按量计费。然而,Max 用户保留捆绑权益的逆转并非源于容量突破,而是对市场竞争的回应。7 月 9 日,GPT-5.6 Sol 达到通用可用性,其费率为每百万输入 token5 美元、输出 token30 美元——输入成本仅为 Fable 5 的一半,输出费率为 60%。在 Artificial Analysis Intelligence Index 基准测试中,Fable 5 得分约 60 分,Sol 约 59 分,两者在通用能力上处于统计学平局。此外,Sol 完成同等任务的成本约为 Fable 5 的三分之一,因其产生的输出 token 更少。
若 Max 或 Team Premium 订阅不提供旗舰模型访问,而竞争对手以更低费用提供近乎相当的性能,将引发严重的用户留存问题。这一分裂策略将 Fable 5 保留为高收入计划的差异化功能,同时将 Pro 订阅者引导至 Sonnet 5 或升级路径。
Fable 5 的溢价逻辑:架构差异与性能权衡
Fable 5 的定价溢价基于其架构承诺。作为首个面向通用用户的 Mythos 级模型,它采用始终开启的自适应推理,无需显式指令即可在每个请求中参与思维链过程。原始思维链不返回响应,仅可见最终输出。这种架构导致 30 天强制数据保留要求,以便监控跨请求的复杂攻击模式,因此 Opus 4.8 及更早模型提供的零数据保留选项不适用于 Fable 5。
规格方面,Fable 5 拥有 100 万 token 上下文窗口,每次响应最多 128,000 个输出 token。当请求触及网络安全利用、生物化学提升或疑似大规模模型蒸馏时,安全分类器会将约 5% 的会话重定向至 Opus 4.8,并返回 HTTP 200 状态码及拒绝原因,允许开发人员处理回退。
在编码基准测试中,优势取决于任务类型。Fable 5 在 SWE-bench Pro 上得分为 80%,领先于 Sol 的 64.6%,但该数据来自 Anthropic 自身评估,尚未由中立方复现。在 Terminal-Bench 2.1 和 DeepSWE 等智能体及基于终端的编码基准中,Sol 表现更强。对于需要长期一致性和扩展上下文的仓库级工作,Fable 5 具有显著优势;而对于常规智能体循环,Sol 的单任务成本优势明显。
对企业团队而言,Fable 5 采用新分词器,从 Opus 4.7 之前模型迁移提示时,token 数量可能膨胀高达 35%,加剧按 token 成本差异。批量 API 定价将费率减半至输入 5 美元 /M、输出 25 美元 /M,适用于非实时负载。
对各计划层级的实际影响
对于 Max 和 Team Premium 订阅者,此次变更是对现有权益的永久澄清:Fable 5 现为捆绑功能,上限为标准周使用限制的 50%。需注意复合效应:自 5 月 13 日实施的 Claude Code 周速率限制增加 50% 的政策已于今日结束,标准限制首先缩小,随后 50% 的 Fable 上限应用于缩减后的基线,重度用户将感受到使用空间的压缩。
对于 Pro 和 Team Standard 订阅者,变更是结构性的。尽管 Claude Code 首席工程师 Thariq 曾确认 Anthropic 旨在计算容量允许时将 Fable 5 恢复至标准订阅,但未提供时间表。技术现实在于,Fable 5 的自适应推理架构比 Opus 4.8 需要更多每 token 计算量,且 30 天安全保留带来合规开销。在每月 20 美元的 Pro 计划中分摊这些成本,与服务每月 100 至 200 美元的 Max 订阅者相比,经济模型截然不同。截至目前,Anthropic 尚无解决这一基础设施和定价策略问题的时间表。
对于任一计划层级,6 月 30 日发布的 Sonnet 5 作为 Free 和 Pro 计划的新默认值,在智能体任务上提供接近 Opus 4.8 的性能,入门价格直至 2026 年 8 月 31 日为输入 2 美元 /M、输出 10 美元 /M。虽不具备 Fable 5 的百万 token 上下文或 128,000token 最大输出,但对于不需要扩展上下文或多天自主会话的工作流,它是最具成本效益的选择。
Kimi K3:7 月 27 日即将到来的开源变量
下周,成本计算格局将进一步变化。Moonshot AI 的 Kimi K3 已于 7 月 16 日通过 API 发布,计划于 2026 年 7 月 27 日公开发布完整模型权重。Moonshot 称其为全球首个达到 2.8 万亿总参数的开源模型,基于混合专家架构,拥有 896 个专家,每 token 仅激活 16 个。这意味着每次推理的实际计算量约为 500 亿参数,2.8 万亿代表权重存储而非活跃计算。其 Kimi Delta Attention ( KDA ) 架构实现了 100 万 token 上下文窗口,声称解码速度比标准注意力快 6.3 倍。由于权重尚未发布,这些声明尚待独立复现。
7 月 27 日的开源权重发布为开发者提供了在不支付 API 费用的情况下自行托管的选择。但这需要数太字节存储空间和大型多加速器设置,并非消费级 GPU 可承载。Moonshot 已向 vLLM 兼容的 KDA 预填充缓存实现贡献代码,但企业团队需自行配置资源。
IPO 临近下的定价承压
Anthropic 于 2026 年 6 月 1 日向 SEC 提交保密草案 S-1 注册声明,目标是在高盛、摩根大通和摩根士丹利主导下于 2026 年 10 月在纳斯达克上市。其上一次私人估值为 9650 亿美元,设定于 2026 年 5 月 28 日关闭的 650 亿美元 H 轮融资中。随着 IPO 临近,证明 Fable 5 能产生持久的按 token 收入,而非作为促进订阅增长的亏损领导者,对 Anthropic 向公共市场展示商业模式至关重要。
今日的计费变更是该论点的首次具体测试。Max 订阅者以计划价格获得 Fable 5 作为福利,Anthropic 可论证这支持了模型计算开销;超过 100 美元额度的 Pro 订阅者则成为支付最高消费者费率的计量 API 客户。该费率能否抵御 Sol 半价竞争的冲击,以及面对下周即将到达的可自托管替代方案,将在 Anthropic 准备公开亮相的过程中实时经受考验。
【星途科讯 图文丨赵晶 首发于 ZAKER 科技,转载请注明出处】


登录后才可以发布评论哦
打开小程序可以发布评论哦