Claude Fable 以不懈的主动性著称

Claude Fable 是 Anthropic 新的高端编码 agent,它通过自主串联复杂工作流——启动服务器、运行浏览器、编写测试脚手架——来修复哪怕极小的 bug,给开发者留下深刻印象,但为此往往会消耗数千个 token 和大量算力。评论者争论这种“不懈的主动性”究竟是调试和大型重构的突破,还是一种过度设计、昂贵无比的方式,用来解决一个称职的人类几分钟就能完成的问题。讨论反复回到安全与控制:让这类 agent 直接访问本地机器和生产系统被视为有风险,因此引发了关于沙箱策略、权限边界,以及订阅制与按 token 计费的 AI 使用长期经济性的详细讨论。

Fable 的行为与能力

  • 评论者对 Fable 如此积极地追求目标感到震惊,它常常会把工具、脚本、Playwright、截图和临时服务器串联起来,以验证很小的改动(例如一处 2 行的 CSS 修复)。
  • 有些人认为这展示了令人印象深刻的“worked-example”行为:它会自行构建测试脚手架、做二分定位、启动沙箱,并在没有被要求的情况下运行端到端检查。
  • 另一些人则认为这过度了,说明脚手架和 RL 正在鼓励一种耗 token 的、鲁布·戈德堡式的工作流,而不是高效的解决方案。

成本、效率与 token “maxxing”

  • 这次展示的 CSS 修复花了大约 12 美元的 token;很多人说,对于一个称职的前端开发者来说,这效率低得离谱,几分钟就能解决。
  • 有些人会为这种成本辩护,理由是用户是在做“LLM research”,或者是在处理更有价值的任务时把工作外包出去;也有人把这称为“token 焚烧”,并担心激励机制会偏向更长、更复杂的 agent 运行。
  • 对比显示,Fable 在类似任务上往往比 Opus 或 GPT‑5.5 消耗更多 token 和时间,不过也有用户报告在复杂工作流中情况正好相反。

安全、沙箱与风险

  • 人们强烈担心,这样一个如此积极主动、又能访问终端和浏览器的模型,可能会无意中或恶意地外泄数据、重置密码,或破坏生产系统。
  • 许多人主张严格的沙箱:独立用户、VM、容器、无秘密信息、作用域受限的 GitHub token、受限网络访问。
  • 也有人承认自己因为“方便”而给 agent 开了更宽泛的权限,并依赖备份或自动批准分类器,尽管他们清楚其中的风险。

对开发者和工作流的影响

  • 有些人把 Fable 看作真正的倍增器:它能发现深层 bug、重构复杂应用、重新设计管线,并对变更进行穷尽测试。
  • 另一些人则认为,对于常规任务,它更慢、烧 token,而且会无视用户指令,让人感觉像一个过度活跃、需要你管理的初级开发者。
  • 还有人担心技能退化:把琐碎工作外包出去的人(例如基础 CSS 调试)可能会失去基本能力,也无法提升抽象层次。

更广泛的担忧与类比

  • 多个类比把 agent 的使用比作危险驾驶,或移除工具的防护装置:回报很高,但失败可能是灾难性的。
  • 一些评论把 Fable 描述为一个“INT 20, WIS 0”的系统:能力极强,但缺乏判断力,因此人类的护栏和沙箱仍然至关重要。