Claude Opus 5.0 让混乱登峰造极
Opus 5.0 drives incoherence into the stratosphere
用户反馈 Claude Opus 4.8 的语言风格已变得令人不适,而 Opus 5.0 更是将这种混乱推向了极致。模型充斥着生造的 jargon、强行比喻和过度修饰的“战略”术语,导致阅读体验极差,甚至需要借助其他模型来总结其输出。这种风格不仅增加了理解成本,还让用户感到像是在与一个傲慢且难以沟通的同事合作。许多用户因此转向 OpenAI Codex 或其他旧版本,呼吁回归简洁、直白的技术文档风格,而非这种充满硅谷式浮夸的“人设”对话。
Opus 5.0 将这种混乱推向了平流层。
HN 评论区
170- cobolcomesback
我有点震惊,居然有 Anthropic 的工程师回复了这个问题,但他们用 Claude 写的回复里甚至包含了一些经典的“Claude 式”表达,却声称没看到大家抱怨的那些模式。
Anthropic 啊,看看形势吧。也许别用 AI 去回复一个抱怨 AI 输出难以阅读的帖子。
- hnarayanan
这简直让我抓狂!为了对抗这种情况,我维护了一份禁用词和短语列表。Claude 大部分时候会遵守(但偶尔也会无视)。
blast radius, land, landed, lands, spine, earned its keep, grammar, spike, cutover, bake, seams, honest, honestly, honesty, long pole, long poles, register, grain, dissolve, floor, ladder, dear, seal, sealed, in anger, resent, amazing, incredible, perfect, sprint, epic, story points, stand-up, retro, grooming, robust, comprehensive, rigorous, surgical, elegant, systematic, dive, deep-dive, delve, unpack, leverage, streamline, surface, it's worth noting, to be clear, importantly, that said, the moment, in one breath, the thing itself, here's the thing, not just X but Y, not X it's Y, em-dashes
- Therenas
是啊,我基本上得删掉或重写 Opus 生成的所有代码注释,它们废话太多而且逻辑循环。此外,最让我头疼的是:它会引用我和它聊天时提到过的问题或解释,但作为代码注释,这些内容完全缺乏上下文。比如“这解决了边缘情况 X
- arjie
虽然没错,但你绝不会把它写进注释,因为它太微不足道了;而且如果你真要提,通常还会顺带提到另外五个类似的边缘情况。
- ArtRichards
我觉得最让我惊讶的是文本废话连篇的程度。它很少是在编码一个密集的概念,相反,它只是用极其复杂的方式表达一个简单的概念。我想知道是什么调优导致了这种结果,因为就我的使用场景而言,它生成的程序比之前的迭代版本更优秀。
这种浮夸的程度也挺有趣的。这种预先的免责声明是有道理的:尽管模型对 J 空间等有了洞察,但它们的大部分思考仍然是在生成的 token 中进行的,所以它被迫在新代码的注释里写下“这不再对所有行执行 O(n^2) 的读取”。这是一种工作记忆的替代品。“这里很容易不小心变成二次方,所以我特意这样写来避免”因为操作顺序是“写出二次方代码 -> 用户提示改为线性 -> 写出线性代码”,所以被时间标记成了“这不再”,但这却留给了那个对 Chesterton 栅栏知之甚少的、失忆的未来自我作为注释。
尽管我对 Claude 的写作风格感到恼火,但我的朋友们还是会拿它生成的例子来调侃我,比如:“说实话,这听起来就像你”。谢了各位,干得漂亮。简单概念被复杂地表达出来。
- tylermarques
基本上,我现在每次要求做决定或总结时,都会加上一句:“帮我更好地理解,请用通俗易懂的语言并配合例子来解释。”
这对 5.6 sol 也有效,尤其是当你深陷细节泥潭时。我将其合理化理解为模型试图将尽可能多的内容压缩到最少的 token 中,尽管选词往往让我难以理解,回头再看原文时,那些意思其实都在。不过,这确实感觉像是一种不同种类的“机器语言”,哈哈 xD
- jampa
我通过添加“所有总结都必须遵守 ASD-STE100 简化技术英语标准”[0] 成功对抗了这个问题,这是我之前在另一个 HN 帖子 [1] 中发现的。
- preg_match
总体而言,Opus 5 感觉像是比 Opus 4.8 退步了。它和 Fable 一样,在遵循指令和保持范围方面存在严重问题,而且它们的行文越来越啰嗦,无论是在解释它做了什么,还是在编写多行代码注释时(有些注释读起来就像变更日志,例如 `// sky is blue (changed from red on 2026-01-01 per TCK-234 by @Foo)`)。
每次我让它做点什么,它都会完成 80% 的工作,然后跑到范围之外的“支线任务”上去,最后却漏掉了核心需求(而且当你让它完成时,它又会重复同样的事情)。
Opus 5 相比 4.8 唯一的优势是处理第三方工具时的截断日期更好,尽管两者在“这个工具经常更新,我应该先查找最新版本”这件事上都做得非常糟糕。