Claude,把“加入购物车”按钮改成蓝色
一个讽刺性的网页“游戏”,模仿要求 Anthropic 的 Claude 把一个“Add to Cart”按钮改成蓝色——结果它却重构了整个 UI、生成子代理,并大谈权衡取舍——引发了开发者的强烈共鸣。许多人说这与他们在 AI 编码代理上的真实挫败感高度一致:这些工具会把琐碎改动复杂化、忽视范围、烧掉 token,并且需要极其细致的提示控制;而另一些人则认为这只是夸张或过时的漫画化形象,与他们在新模型或更好 harness 下的体验并不相符。这场争论凸显出一个更大的张力:AI 工具确实能大幅加速复杂工作,但其不可预测性、冗长以及“热心”地自作主张的倾向,会让哪怕只是简单编辑,也像是在和一个随机的同事拉扯。
对这个仿讽站点的整体反应
- 许多人觉得这个交互式“把 Add to Cart 按钮改成蓝色”的仿讽很搞笑、很让人焦虑,也很令人不舒服地有共鸣,把它形容为身体层面的烦躁(“眼皮抽搐”“血压飙升”“PTSD”)。
- 也有人说这和他们使用 Claude 的体验完全不符,觉得像是稻草人式的批评或过时的漫画化形象。
- 还有不少人称其为“精英级讽刺”和“90 年代末的网络艺术”,称赞它非常准确地捕捉了与 LLM 争论微小改动时的那种 感觉。
“这正是我的体验”阵营
- 相当一部分人表示,这种讽刺和他们在 Claude/Opus 5 上的真实经历高度相似:
- 过于冗长、伪诚恳的“Claudese”式语言和各种保留意见。
- 把简单任务过度工程化、范围蔓延,以及 yak-shaving(“23 个代理”、不必要的重构、测试、工具、服务条款)。
- 很难在不引入附带改动的情况下完成局部、小范围的代码编辑。
- 代理会烧掉大量 token,生成子代理,并在琐碎或全新项目上执着于验证和向后兼容。
- 有些人说自己转向了其他工具(Codex、DeepSeek、GLM 等),因为他们觉得 Claude 过于“热心”、太慢或太让人沮丧。
“这不符合现实”阵营
- 许多经常使用 Claude 的人说,他们从未见过这么糟糕的行为:
- 他们觉得 Opus/Sonnet 通常都很精确,尤其是在给出明确的文件/行号引用和良好的项目文档时。
- 在他们看来,Claude 的主要缺点是啰嗦和过度注释,而不是大规模、破坏性的改动。
- 他们认为这个站点是夸张的讽刺,会误导人们对当前模型质量的判断,或者反映的是更早期的模型世代。
提示方式和用户行为
- 一些评论者认为,这个“游戏”本身会迫使人们使用糟糕的提示:
- 带情绪的责骂(“我只要一个按钮”)、模糊指令,以及没有给出如何修复错误的具体说明。
- 他们强调,使用 LLM 时必须避免发泄情绪,明确目标范围,并重申约束条件。
- 建议的最佳实践包括:
- 把模型当成数学工具,而不是人;跳过情绪化语言。
- 提供精确上下文(文件、选择器、类名),而不只是“把按钮改成蓝色”。
- 撤销坏改动并开启一个全新的会话,而不是在被污染的上下文里“争论”。
- 维护 CLAUDE.md / AGENTS.md / PROJECT.md,并持续完善它们。
- 限制工具/子代理的数量,保持上下文尽量精简并聚焦任务。
更广泛的主题:AI 工作流、赌博感与疲劳
- 有人指出,LLM 会让人感觉像赌博或可变奖励老虎机:长时间的挫败之后偶尔出现一次巨大的成功,让人不断上瘾。
- 也有人强烈反对这种赌博类比,认为他们体验到的是相当稳定、渐进的进展。
- 一个反复出现的主题是“harness engineering”:构建定制的编排、工单和审查代理,让人类很少直接和原始模型对话,以此管理挫败感和复杂性。