DeepSeek V4 Flash erreicht 89 % im ARC-AGI-1-Benchmark

DeepSeek V4 Flash 0731

DeepSeek V4 Flash erreicht 89 % im ARC-AGI-1-Benchmark

DeepSeek V4 Flash 0731 erzielt im ARC-AGI-1 Semi-Private-Test 89,0 % bei maximalem Aufwand – und das für nur 0,02 $ pro Aufgabe. Im anspruchsvolleren ARC-AGI-2 schafft das Modell 61,4 % (0,04 $ pro Aufgabe). Die Ergebnisse sind auf der ARC-Prize-Website veröffentlicht und zeigen die Leistungsfähigkeit des Modells in verschiedenen Reasoning-Varianten.

Bei maximalem Aufwand erreicht DeepSeek V4 Flash 0731 89,0 % im ARC-AGI-1 Semi-Private-Test für 0,02 $ pro Aufgabe und 61,4 % im ARC-AGI-2 Semi-Private-Test für 0,04 $ pro Aufgabe.

Mehr von diesem Tag

2026-08-07