LLM 退化成垃圾,是我幻觉吗?

LLMs .what do you smoke beforehand?

我觉得自去年十月起,LLM 被故意削弱了,现在输出全是垃圾,甚至不如不用。我试过用 Claude 写简单的 HTML 网站,结果它思考 50 分钟却产出极差,远不如我手写。难道是我需要‘嗑药’才能看到 LLM 的价值?

LLM 确实退步了,尤其是 Claude,现在为了安全过度审查,导致它拒绝执行简单任务,完全违背了用户初衷。
问题可能不在模型本身,而是我们过度依赖 LLM 做它不擅长的事,比如创意生成,而忽略了它在代码补全等任务上的优势。
LLM 的退步是商业策略的结果,公司为了控制成本和风险,故意降低了模型的推理能力,导致用户体验大幅下降。