GPT-6 Astra übertrifft menschliche Effizienz auf ARC-AGI-3
OpenAI's GPT-6 Astra on ARC-AGI-3

OpenAIs GPT-6 Astra erreicht mit 99,9% einen neuen Spitzenwert auf dem ARC-AGI-3-Benchmark, der agentische Intelligenz in unbekannten Umgebungen testet. Bemerkenswert ist, dass Astra auf 96% der Level weniger Aktionen benötigt als der menschliche Median und dabei eigene kompakte symbolische Notationen entwickelt. ARC Prize betont, dass dies ein bedeutender Fortschritt, aber kein Beweis für AGI ist.
Astra benötigte auf 96,0% der Level weniger Aktionen als die menschliche Baseline und durchschnittlich 51,7% weniger Aktionen pro Level – ein materieller Meilenstein.