Anthropic 的最佳 AI 模型在更便宜工具蓬勃发展的情况下难以吸引用户
尽管 Anthropic 的顶级 Fable 5 模型在复杂、长周期的编码和研究任务上通常被认为更有能力,但与更便宜的选项相比,它吸引到的使用量相对较少,例如 Opus、GPT‑5.6 “Sol” 以及快速崛起的中文开源权重模型。评论者指出,高成本、激进的使用限制、侵入性的安全护栏、企业缺乏零数据保留,以及反复无常的定价和政策变化,都是主要阻碍;而如今“够用”的模型已经很多,并且便宜得多。许多人认为,这表明当智能提升到某个阈值之后,实际收益会迅速递减,AI 正在走向一个商品化、成本敏感的市场,而不是一路奔向高价的前沿领域。
模型采用与“够用”的智能
- 许多评论者表示,Fable 5 的前沿级能力对大多数日常工作(编码、邮件、摘要)来说并非必需。
- 更便宜的模型(Opus 4.6/4.8、Sonnet、GPT 5.6 Sol、DeepSeek、GLM、Qwen、Kimi)被视为“够用”,尤其是在与优秀的 harnesses/agents 配合时。
- 一些人认为,我们可能正接近一个“够用”的平台期,在前沿研究或非常复杂的工程之外,增量智能带来的价值很小。
定价、配额与商业策略
- 人们对 Anthropic 不断变化的订阅层级、Fable 访问窗口以及不透明的 5 小时 / 每周限制表示强烈不满。
- 多位用户表示他们会在会话中途碰到限制,被迫“token-maxx”,或者购买多个账户或更高等级套餐。
- 许多人认为 Anthropic 在激进地按 token 变现,像一个“token merchant”,这与竞争对手更慷慨或更可预测的配额形成对比。
质量、回归与护栏
- 普遍的感受是 Opus 5 更慢、更啰嗦、更居高临下,而且经常不如 Opus 4.6/4.8;一些人怀疑存在静默降级或基础设施变更。
- 少数人赞扬 Fable 在长周期规划、复杂重构以及自主多小时代码改造方面的表现,但另一些人认为 Sol 或 K3 在更低成本下同样好,甚至更好。
- 安全护栏是一个重大痛点:Fable 和 Opus 经常拒绝良性的安全、生物、认证或系统类问题,或者静默降级模型。
企业与合规(ZDR)
- Fable 在企业中的一个关键阻碍是缺乏零数据保留;多家组织因此禁止使用它。
- 一些人认为这源于监管压力以及 Anthropic 希望分析多请求攻击模式。另一些人则将其视为监控和信任问题。
隐私、信任与 UX
- prompt 指纹识别 / 隐写术事件被提及为严重的隐私侵犯和信任破坏。
- 用户不喜欢 A/B 测试行为、自动“auto-mode”切换,以及不断变化的模型人格;他们希望工具稳定、可预测。
竞争、本地模型与泡沫讨论
- 许多人表示已将重型工作迁移到 OpenAI Codex/Sol、通过 OpenRouter 使用中文模型,或者自托管 Qwen/GLM/DeepSeek,通常纯粹是出于成本和可靠性。
- 一些人预测 LLM 会成为可在本地运行的廉价商品;他们对基础模型实验室的护城河和 AI 股票估值持怀疑态度。