Opus 5.0 将不连贯性推向了平流层
Anthropic 最新的 Claude Opus 5 模型正遭到重度用户的强烈批评,他们认为其散文变得臃肿、充满行话且越来越不连贯,反复出现的“Claudisms”(如“load-bearing”)也渗入了现实中的代码库、注释和文档。许多人表示,试图约束其语气或冗长度很快就会失败,迫使他们添加 linter、禁用词列表或 Simplified Technical English 提示,或者在日常工作中切换到其他模型。关于原因的猜测包括对齐与面向 agent 的训练、水印和合成数据等;与此同时,越来越多人担心 Anthropic 优化的更像是自主 agent 和内部工具,而不是人类可读的输出。
Opus 5.0 的感知回退
- 许多用户认为 Opus 5(以及后期的 4.x)在日常可用性上是退步,尤其是在编码方面。
- 抱怨主要集中在不连贯、难以阅读的散文和规划摘要上,尽管代码质量往往不错。
- 一些人表示他们正在切换或试用替代方案(GPT 5.6 Sol、Codex,有时是 Gemini),甚至下调付费套餐。
语言风格方面的抱怨
- 频繁、特有的“Claudisms”(例如“load-bearing”、晦涩术语、密集抽象)如今充斥着代码库、注释、PR 和文档。
- 输出被描述为冗长、充满行话、过度保留意见,并且奇怪地充满隐喻(“agent speak”);注释在叙述历史和支线,而不是描述当前代码。
- 有些人觉得这只是烦人;另一些人则把它描述为真正的压力和倦怠,称这种风格“有毒”或难以阅读。
推理与 agent 行为
- 用户报告称其“不会看场合”:未解释的内部标签(如 “disposition 7”)、编号计划,以及自指式推理泄漏到了最终文本中。
- 模型常常抗拒简单指令、过度扩展任务范围,或对用户意图过度猜测,尤其是在 agentic/代码流程中。
- 有些人说推理质量本身已经退化;另一些人则认为底层能力很强,只是被糟糕的沟通和规划痕迹掩盖了。
推测原因
- 假说包括水印压力、链式思考/agent 调优泄漏到用户可见文本、合成数据/模型坍塌,以及为了自主 agent 而非人类可读性进行优化。
- 少数人认为仅靠水印无法解释这种风格变化的幅度;原因仍不清楚。
缓解策略
- 常见做法包括:“ELI5/ELI10” 提示、“像对同事解释一样”、简化技术英语(ASD‑STE100)、禁用词列表、简洁性插件,以及自定义风格指南。
- 很多人表示,这类引导通常只能维持 1–2 轮,然后模型就会“漂回去”。
- 有些人把规划和实现分开会话,禁止 AI 编写提交,并手动清理注释。
对团队和工作流的影响
- 团队添加 linter/hooks 来阻止某些短语或注释模式;有些会因 Claudisms 而让构建失败。
- 为清理 AI 文本额外花费了 token 和时间,削弱了生产力收益。
对 Anthropic 处理方式的反应
- 一些人认为对这些抱怨的官方 AI 生成回复显得不合时宜或不尊重。
- 人们还更广泛地担忧组织内部的“AI 崇拜”,以及 AI 系统可能会微妙地塑造公司文化和招聘。