GPT-6 Astra 在 ARC-AGI-3 上超越人类效率
OpenAI's GPT-6 Astra on ARC-AGI-3

OpenAI 的 GPT-6 Astra 在 ARC-AGI-3 基准测试中展现了惊人的代理智能。在使用 Provider Adapter 架构时,它取得了 99.9% 的得分,且在 96% 的关卡中,其操作效率甚至超过了人类基准。Astra 不仅能快速理解陌生环境,还能自发创造紧凑的代数符号语言来构建世界模型和规划行动。这一突破标志着 AI 在无需明确指令的情况下,已能像人类一样高效地探索、建模并解决问题,缩小了与通用人工智能(AGI)的差距。
Astra 的关键行为在于它能够将陌生的环境转化为紧凑的符号世界模型,将游戏机制表示为逻辑规则,并开发出自己的领域专用语言简写来跟踪状态和规划行动。