appso 21小时前
实测完 Fable 5.1,我再也不想被 A 社割了
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_font3.html

 

APPSO 今早打开 Claude code,满心欢喜的想要体验一下最新的 Fable5.1 模型时,Max 5x plan 的 5 小时用量只有 17%。

我切到 plan mode, 发了一条 Prompt,让它分析我的需求,调研相关领域发展。过了大概十几分钟,我回来一看使用量,变成 90% 多了?!

随后,Fable 5.1 又派出去几个子 Agent 干活,我们剩下那点额度直接被刷空 ...

刚想用 Fable5.1 干活,结果刚雇到工人,项目直接停工了可还行 ..

对用户来说,这确确实实就是一次 bug 级的体验。

究竟是计量、调度还是页面延迟,是 Anthropic 应该说清楚的事情;从我们的体验来说,一条还在规划阶段的 Prompt,10 分钟左右吃掉了大半个 5 小时 limit,是实打实的事实。

Fable5.1 的第一个全民 Benchmark,是看谁的额度先挂掉。

发布日送的额度,十来分钟就刷爆了?!

今天, A 社罕见的大方了一次,重置了所有用户的使用量。

官方的发布贴,已经有了大约 1418 万次浏览和近 6 万次点赞。评论区一开始跟过年了似的,底下网友都在庆祝——刚见底的额度又回来了,新模型随便冲;

也有外国网友在底下评论,「 我都已经等着看中国媒体如何报道中国 AI 吊打 Fable 5.1 了。」

一名 Max 5x 用户说,自己的 5 小时窗口从 0% 到 100% 只用了 17 分钟就刷完了。

他开启了动态工作流,让模型审查 Android、iOS、Django 等多端系统,后台派发了 20 多个 Agent。不过这位用户对模型的完成度还是很满意,他说 Fable5.1 实际上做的相当不错。

另一名 Max 20x 用户发现,Fable 5.1 没按配置调用 Opus 5,反而自己搞出去 4 个 Fable 5.1 fork。也是大概 20 分钟,5 小时窗口就干满了。

更怪的是,官方 X 发布帖下还有用户追问,说他当时用的仍是 Opus 5,使用方式也没变,但模型更新、额度重置以后,5 小时限额同样明显烧得更快??

很快,X 上就开始怨声载道。@joseph_dibb 发推文说,他刚用 Fable 5.1 约 10 分钟,就撞上了 Session Limit;

@kimmonismus 喷得更加有理有据。他一边跑 Fable 5.1,一边跑 GPT-5.6 Sol Ultra,最后给出的体感是:5.1 的额度消耗甚至比 Fable 5 更糟 ....

额度恢复正常后,Fable5.1 终于开始展现实力

APPSO 推测 Fable5.1 早上这波不合理的额度消耗,可能是计量漏洞。为了给大家呈现更完整的测评,我们等到下午重置以后重新测试了一波。

还好,这次貌似恢复正常了,没有那么离谱的额度消耗。

APPSO 交给 Fable5.1 一个相对复杂的任务,让他做一个 AI 科研工作台,可以由用户自行接入 API, 调用 agent 归纳研究脉络,梳理 idea 等等。

我们提出的要求是:相对于市面上主流的 AI 论文阅读工具不同的工具,你要做出增量改进,否则用户直接去和 AI talk 就可以了,没必要使用这个工具。

这次我们也学聪明了,让 Fable5.1 先做个 demo 出来看看效果,防止额度消耗再次爆炸。

最后,Fable5.1 在 5h 额度范围内,交付了第一版成品,可视化脉络梳理做得很好,视觉交互也很高级;接入 OpenAI 的 API key 以后,也能很流畅的和 agent 对话,让 agent 去搜新的论文入库,解释专业术语等等。

由于额度限制,这版目前只是一个 demo, 不过后续我们会不断完善功能,做出一个可以复用的 AgentLab,说不定未来会部署到 github 上供大家使用

在写作层面,Fable 5.1 也有比较明显的提升。相比 Fable 5,它更会控制结构和篇幅,少了一些重复的解释,写出来的段落也更自然。

Amp 的首发测试甚至说,写作是他们对 5.1 最印象深刻的地方。他们以前不太喜欢 AI 写东西,但通过这次测试,他们感觉 5.1 更像人在写东西:会解释「 为什么这个改动重要」,而不是把所有技术细节全倒出来。

Fable5.1,难道我错怪你了?

一条 Prompt,背后可能站着一家「小型 agent 公司」

额度烧得快,也不代表模型啥都没干。恰恰相反,没准 Fable 5.1 最让人又爱又恨的地方,就是它太能自己找活干了。

Every 的首发实测发布了一份账单。他们获得 Fable 5.1 访问权限后,Claude Code 每日记录的 request 变成了之前的 5 倍多——从日均大约 910 次,上升到 4688 次。

这事儿其实也侧面印证了官方的能力介绍,Fable 5.1 让 Claude Code 更愿意自己往下跑、更频繁地调用模型、使用 subagents、执行自动化流程等等。

网友现在苦不堪言的问题,「我明明只发了一个 Prompt,但是额度咋没了?」其实对 Agent 模型来说,一个 Prompt 早就不等于一次普通的请求了。

Every 的测试者还发现,Fable 5.1 在最高的 Effort 下会持续工作、不断分派子 Agent,有时甚至不会因为用户让它停下解释就立刻停住。这名测试者一天跑了 18 亿的 Token。

X 上一名日本开发者也做了一个极端但很有参考价值的测试,他在几个小时里并行烧掉约 9 个 5 小时窗口。他认为 5.1 最重要的变化不是「强大很多」,而是「好用很多」。但他同时也发现,同类任务在 Low 下约 2.5 万 Token,切到 xHigh 后涨到约 20 万 Token。

A 社的官方 Prompt 指南专门提醒 Agent 开发者:不要让主 Agent 停下来等每一个子 Agent。启动子 Agent 的工具应该立即返回,让主 Agent 继续干别的,等子 Agent 完成后再把结果送回来。

A 社的意思是,这样可以在质量、Token 和成本大致相近的情况下缩短完成时间。

不过这事儿,还不单单是「5.1 更爱干活」这么简单。

在使用 Claude Code 的过程中,一条 Prompt 背后可能会拉起多个子 Agent。当用户给模型说 : 子 agent 只使用 Opus 模型,并不一定代表后台每一个 Agent 都真的只用 Opus。

为了展示这个流程,APPSO 让 Fable-5.1 做了一个「AI Agent 为什么会烧掉这么多 Token」的动画,推理强度为 medium;

我们还特意在 Prompt 里写了诸多限定词,例如:禁止启动子 Agent、不联网、不搜索资料、做到差不多就停止等等。

此外还有个小细节,Anthropic 在 Fable 5.1 上线时,还专门加了一个新的强制开关。只有打开它,才能保证所有子 Agent 都固定使用指定模型。

这样看来,前面那些「明明设了 Opus,结果后台却跑出了 Fable 5.1」的情况,也并不是完全说不通。

Fable 5.1   真的便宜了吗

A 社嘴上说的更便宜,其实 Fable 5.1 的 API 并没有整体降价。

输入、输出仍然是每百万 Token 10 美元和 50 美元。A 社降下来的是 Cache Read,也就是重复读取已有上下文时的价格。所以据他们估算,典型任务的成本可以下降约 25%,高度 Agent 化的任务最多下降约 45%。

但 Max 用户的额度完全是另一回事啊!要是真便宜了,咋还有这么多用户抱怨呢?

感觉他们这个定额绝对有点说法,让你浅尝辄止,能做成 demo,但是又做不成完整的产品。

想继续用?那就继续升级为尊贵的 20x 用户吧!(dog)

此前,社区就有人根据自己的账户反推过这套额度。A 社被人曝 Max 20x 的每周总额度大约只有 Max 5x 的两倍,而不是四倍。如果只看 Fable,可用量的差距甚至只有约 1.5 倍。

Fable 5.1 上线后,模型本身也会跑更多步骤。

一条 Prompt 背后,可能包括拆任务、启动子 Agent、跑测试等等复杂的请求。

所以,API 端的降本和 Max 用户觉得额度更不经用,并不冲突;单次调用可能更便宜,但如果一次任务实际跑了更多轮,最后消耗的总额度仍然可能更高。

何时该用这位额度吞噬者?

今天,Anthropic 还公开更新了 Fable 5.1 的核心系统提示词。

其中有两条放在一起挺有意思:如果模型在执行大量的工具调用,应该时不时的给用户汇报一下;但如果用户问自己还能发多少消息、会花多少钱,模型要回答「不知道」,再让用户自己去帮助中心看。

也就是说,它被教会了在长任务里定期汇报施工进度,却依然算不准调用它自己的开销。咱们要用的时候,还是要勤看着点 /usage,小心被它吞了太多额度。

Fable 5.1 最合适的场景,还是真正困难、周期够长、验收标准明确的任务:大仓库重构、跨服务排障、复杂研究、可以放一夜的 Agent 工作。这样的任务里,多开几个 Agent 可以用算力换时间,也不算浪费。

但它真的不该成为「先随便问问」的默认选项,一般用户基本没必要用。

日常规划、普通代码审查、仓库摸底,我会继续先用 Opus 5。真要调用 Fable 5.1,就开新会话,从 Low 或 Medium 开始,我还得限制 Agent 数量,要不真撑不住。

Fable 啊,你可别再十分钟给我 5h 的额度都刷没了,那我只能回归赛博义父 Tibo 的怀抱了。(期待 Astra)

最后,既然不少人都说 Fable 5.1 的写作能力提升很大,那就让它自己写一句最想对读者说的话,作为这篇文章的结尾——

「你们数着额度看我,我数着 token 看你们。愿我们都学会把有限的预算,花在真正值得做完的事上,无论是我的上下文窗口,还是你们的一生。」

我们正在招募伙伴

简历投递邮箱hr@ifanr.com

✉️ 邮件标题「姓名 + 岗位名称」(请随简历附上项目 / 作品或相关链接)

更多岗位信息请点击这里

宙世代

宙世代

ZAKER旗下Web3.0元宇宙平台

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论