OpenAI发布GPT-5.6,性能吊打Claude Fable 5

OpenAI发布GPT-5.6,性能吊打Claude Fable 5

OpenAI正式推出GPT-5.6系列模型,包括旗舰版Sol、均衡版Terra和性价比版Luna。Sol在Agents' Last Exam中创下53.6分新高,大幅超越Claude Fable 5,同时成本仅为后者的四分之一。该系列在编程、网络安全及科研领域均实现State-of-the-art表现,并引入ultra模式协调多Agent并行工作。无论是处理复杂代码还是生成专业文档,GPT-5.6都展现出更强的设计判断力和效率,让每美元产出更高价值。

GPT-5.6 Sol在Agents' Last Exam评测中创下53.6分的新高,以13.1分的优势超越Claude Fable 5,且预估成本仅为后者的四分之一。
  • 有用户指出 GPT-5.6 在代码重构中展现出优于旧模型的判断力,能避免为完成指令而破坏代码库,但高吞吐量导致成本优势不明显。
  • 评论者强调提示词优化的核心在于控制模型的词汇空间(lexical complexity)而非单纯的信息密度,通过限制可用词汇比使用否定指令更有效。
  • 部分开发者认为工具效率的提升引发了关于‘过程’价值的哲学争议,质疑若完全依赖 AI 生成成果,人类在劳动中的主体性将不复存在。
  • 有从业者对比 Codex 与 Claude,指出 Claude 的用量限制不适合全天候编码,而 OpenAI 的 ChatGPT 与 Codex 用量分离机制提供了更高的性价比。

同日更多故事

2026-07-09