Eine Woche mit Codex statt Claude: Meine schnellen Eindrücke

Quick impressions: A week of using Codex more than Claude

Eine Woche mit Codex statt Claude: Meine schnellen Eindrücke

Der Autor hat eine Woche lang Codex intensiver genutzt als Claude und teilt persönliche Beobachtungen. Codex erzeugt weniger Code-Kommentare und einfachere Architekturen, wirkt aber technischer und weniger wie ein Teamkollege. Claude geht eher über das Geforderte hinaus, während Codex bei Fehlern wie Rebasing Probleme bereiten kann. Auch die Integration mit Jira und MCPs unterscheidet sich. Ein ausführlicherer Vergleich folgt.

Claude fühlt sich eher wie ein Kollege in einer Tuple-Session an, während Codex eher wie eine Version von Data aus Star Trek wirkt.
  1. 217

    Während alle irgendwie immer noch an Claude hängen und davon fasziniert sind, hier euer kurzes Update zum Stand der Dinge bei Coding-Modellen und -Harnessen Mitte August 2026. Codex ist gut, sowohl CLI als auch Desktop-App, man bekommt viel Nutzung bei jedem Plan. Sol ist gut! Und erledigt die Arbeit, schreibt oder diktiert einen sehr langen und durchdachten Prompt und lasst Sol xhigh oder max fast eine Stunde oder so daran arbeiten. OMP ist ein erstaunlicher Harness, jede Funktion, die Claude Code oder Codex hinzufügen, ist dort wahrscheinlich schon seit ein paar Monaten vorhanden. Guter Harness, den ich allen meinen Entwicklerfreunden empfehle, aber für alle anderen ist Codex die bessere Option, wegen seiner Einfachheit und der Plug-and-Play-Option. Claude ist anständig, aber nicht großartig. Alle Modelle werden irgendwie restriktiver. Man bekommt praktisch unbegrenzt Opus bei Max-Plänen, Fable ist gut, aber langsam, und die willkürlichen Leitplanken nerven so sehr, dass ich es seit Wochen nicht mehr benutzt habe. Gemini 3.7 ist großartig für Geschwindigkeit. Alle schlafen darauf, sogar ich. Kimi k3 – großartig für Frontend, eines der wenigen Modelle, das bereit ist, Verbrechen für dich zu begehen UND die Intelligenz hat, um eine Chance auf tatsächlichen Erfolg zu haben. DS Pro und Flash sind schnell, aber nicht etwas, das ich für wichtige Dinge tatsächlich nutzen würde, im Gegensatz zu Sol, Fable und vielleicht 3.7 hier und da. GLM 5.3 habe ich noch nicht getestet. Ehrenvolle Erwähnung für lokale Modelle, die jetzt tatsächlich gut werden! 5090er werden in den kommenden Monaten weiter und weiter teurer werden. Leider. Es gibt so viel mehr als Claude auf dieser Welt und es ist […]

  2. mewse-hn

    Ich habe nur das 20-Dollar-Claude-Abo. Letztes Wochenende hatte ich eine ziemlich schwere Aufgabe (Portierung von Quake auf Raspberry Pi nativem GLES 1.0) und habe zweimal mein Claude-Kontingent aufgebraucht, dann habe ich mich mit Luna in OpenCode eingeklinkt und alles für etwa 0,40 Dollar an Tokens fertiggestellt, was beeindruckend war. Da Opus 5.0 im Vergleich zu 4.8 ziemlich mäßig ist, denke ich, dass Anthropic in Schwierigkeiten steckt.

  3. agentdev001

    Ich bin sicher, es hängt von der Art der Arbeit ab, aber für meine ist Codex viel hilfreicher. Ehrlich gesagt läuft es meistens darauf hinaus, dass es deutlich schneller ist, wahrscheinlich weil es, wie viele gesagt haben, darauf abgestimmt zu sein scheint, keinen Wortschwall auszuspucken, sowohl in seinen Chat-Interaktionen als auch in seinem Code (Claude ist besessen von massiven Kommentarblöcken, die praktisch garantiert zu totem Kontextrauschen werden, wenn man es jemals nutzt, um Code zu iterieren). Ich mache meist sehr obsessive, eng umrissene, sorgfältig durchdachte kleine Änderungen an einem ziemlich langweiligen Stack, eine Interaktion nach der anderen, und verifiziere Funktionalität und Code. Ich weiß, was ich tue, aber ich weiß auch, was ich nicht gerne tue (genau die gleichen Dinge, die ich schon ein Dutzend Mal in meiner Karriere gemacht habe).

  4. corytheboyd

    Ich versuche, meinen Teil zur Welt beizutragen. Dieser Beitrag braucht eine Bearbeitung. Der Autor vergleicht nicht „Codex“ und „Claude“. Er vergleicht Codex TUI/CLI mit (vermutlich) gpt-5.6-sol gegen Claude Code TUI/CLI mit (vermutlich) Claude-Opus-5. Strg + F > [5.6, sol, sonnet, opus oder fable] liefert keine Ergebnisse. „Claude“ ist eine Produktfamilie, die Modelle und Harnesses (und wahrscheinlich mehr) umfasst. „Claude Code“ deckt sowohl die Claude Code TUI als auch CC in der Claude-Desktop-App ab. „Codex“ ist dasselbe und könnte sich auf die Codex TUI oder Codex in der ChatGPT-Desktop-App (ehemals Codex) beziehen. (Und nun ja, historisch gesehen, gpt-5.*-codex.) Wenn ich höre „Ja, Claude ist großartig zum Coden“, kostet mich das eine Stunde Lebenszeit. Irgendwas mit „Schatz, warum spielst du nicht noch ein bisschen mit deinem Nintendo und kommst dann zum Abendessen?“

  5. stillpointlab

    > Codex fühlt sich eher wie eine Version von Data aus Star Trek an. Großartige Analogie aus irgendeinem Grund. Zuerst fand ich Codex Sol ein bisschen kälter. Aber jetzt, wo ich seit mehreren Wochen damit arbeite, ist es mir ans Herz gewachsen, hat sogar etwas Persönlichkeit gezeigt. Ich schätze, dass es etwas geschäftsmäßiger ist, Fable ist manchmal ein bisschen zu freundlich, wenn es sich auf die Arbeit konzentrieren sollte. Codex kann ein bisschen pingeliger sein. Ich stimme den meisten seiner anderen Beobachtungen zu. Ich habe bereits begonnen, Aufgaben danach zu sortieren, welches Modell meiner Meinung nach am besten geeignet ist. Im Allgemeinen greife ich für klar umrissene und geradlinige Aufgaben, bei denen ich Code heraushauen möchte, zu Codex. Für weniger spezifizierte Aufgaben, bei denen ich eine breitere Sicht brauche und möchte, dass das Modell mehr Details ausfüllt, greife ich zu Fable. Beide sind großartig und sie sind ein gutes Team zusammen.

Mehr von diesem Tag

2026-08-21