GPT-6.1 Sol erreicht fast Astra-Intelligenz – zu einem Viertel der Kosten
GPT-6.1 Sol replaces GPT-6 Sol after just 7 days, with near-Astra intelligence

Nur sieben Tage nach GPT-6 Sol legt OpenAI mit GPT-6.1 Sol nach: Der Intelligence Index steigt um 4 Punkte, nur 1 Punkt unter GPT-6 Astra. Beim Preis pro Aufgabe kostet das Modell mit 0,72 $ weniger als ein Viertel von Astra (3,26 $) und 31 % weniger als GPT-6 Sol. Besonders stark sind die Zugewinne bei agentischer Wissensarbeit, Terminal-Bench 4.0 (+12) und AA-Omniscience, wo die Halluzinationsrate von 60 % auf 54 % sinkt. Allerdings verbraucht GPT-6.1 Sol 10–30 % mehr Output-Tokens.
GPT-6.1 Sol gains 4 points in the Intelligence Index vs GPT-6 Sol, and 5 points vs GPT-5.6 Sol - landing 1 point below GPT-6 Astra.
- atkrista
Ich würde es einfach LIEBEN, all das hinter den Kulissen ablaufende Shithousery zu sehen, mit dem beide Unternehmen versuchen, sich in diesem weitgehend 2-Pferde-AGI-Rennen gegenseitig zu übertrumpfen. Jemand sollte eine Mockumentary machen, wenn alles gesagt und getan ist!
- bearjaws
Was haben die Leute davon, so reduktionistisch zu sein?
Jedes Mal, wenn ein neues Modell herauskommt, kommen die Leute in Scharen und sagen: "Oh, ich merke keinen Unterschied".
Die Leute sagen das jetzt seit 2 Jahren über <currentModel-1>, und der gesamte Zustand der KI hat sich dramatisch verändert.
Es kann nicht sein, dass das nächste KI-Modell nicht besser ist, aber gleichzeitig plötzlich das, wozu sie fähig sind, auf einer völlig anderen Ebene liegt.
- roody15
Ich vermute, Google hat ein Modell, das auf demselben Niveau ist, aber strategisch wartet, anstatt diesen ständigen Woche-für-Woche-Sprint hinzulegen.
Es scheint mir immer noch, dass Google mit KI allein aufgrund seiner Größe und seines Ansatzes in einer guten Position ist.
- egeozcan
Die Sorgen, dass KI außer Kontrolle gerät, ziehen so viel Aufmerksamkeit auf sich, dass sich anscheinend kein Governance-Gremium um das zwielichtige Abo- und Limit-Geschäft kümmert.
- Dinuda
Nach 5.5 bemerke ich im Grunde keinen Sprung in der Modellleistung, außer dass meine Nutzung früher endet.