Claude Opus 5.5 denkt schneller und löst Aufgaben mit weniger Tokens
Prompting Claude Opus 5.5
Anthropic hat Claude Opus 5.5 veröffentlicht, das 30 Prozent schneller Tokens generiert und Aufgaben mit weniger Tokens abschließt als der Vorgänger. Der Leitfaden erklärt, wie man den Effort-Level kalibriert, Thinking in API-Integrationen und Chats steuert, Fortschrittsupdates für Nutzer einbaut, unbeaufsichtigte Agenten am Laufen hält und mit Safeguard-Refusals umgeht. Bestehende Prompts für Claude Opus 5 funktionieren weiterhin, einige Anpassungen sind jedoch nötig.
Claude Opus 5.5 generates output tokens more than 30 percent faster than Claude Opus 5 and tends to finish the same task with fewer tokens.
- skeledrew
Was mir immer wieder ins Auge springt, ist, wie sie es so eingestellt haben, dass es sich weigert, Nutzern Thinking-Tokens und Prompts für die vollständige Argumentation in der Ausgabe zu geben. Das treibt mich nur noch weiter weg; ich werde Claude vorerst vielleicht nicht komplett aufgeben, aber ich werde noch mehr meiner Hauptarbeit zu chinesischen Anbietern verlagern. Dort ist jetzt Offenheit und Freiheit zu finden.
- bluegatty
Das ist ein Versagen der AI-Foundries; wenn wir für jedes Modell völlig unterschiedliche Prompting-Techniken verwenden müssen, wird das nicht funktionieren.
KI stößt schnell an die Grenzen ihrer Nützlichkeit, und diese Produkte müssen endlich ausgereift werden.
Es ist nicht 'lustig', 50 verschiedene kaputte MCPs zu verwalten und die Vielfalt ihrer Arten, kaputt zu sein.
Am Anfang war es 'lustig', jetzt ist es einfach nur 'kaputte Technologie'.
Astra und Opus 5.5 sind der 'Ausgangspunkt' für die nächste Ära der KI, in der wir robuste Tooling erwarten.
- prodigycorp
Opus 5.5 ist ein gutes Modell, aber ich habe versucht, den extremen Hype darum in den sozialen Medien über Opus' Fähigkeit, 2D-Arbeit zu erledigen, zu verstehen, so wie wir es bei Astra mit 3D-Arbeit hatten. Bei beiden Releases brauchten die Modelle umfangreichen Zugriff auf Third-Party-APIs, um Assets dafür zu generieren, und ein Großteil der Arbeit des Modells bestand im Wesentlichen darin, alles zu koordinieren.
Es gibt so viel Zeug wie "x hat das in einem Schuss generiert, das ist AGI", das einem den Eindruck vermittelt, man könne moderne Modelle genauso im Vibe-Modus bedienen wie die Modelle vom letzten Jahr. Es steckt so viel mehr dahinter. Es verlangt von einem, auf den Sprung in der Fähigkeit der Modelle zu vertrauen, einen, der bei früheren Modellen sicher Zeitverschwendung gewesen wäre.
Ich bin mir nicht sicher, worauf ich hinauswill, außer dass ich denke, die meisten können sich darin wiederfinden, dass es erschöpfend ist, mitzuhalten. Ich kann mir nicht vorstellen, wie es wäre, ein Kind großzuziehen, das in einem Jahr vom Kleinkind in die Pubertät gekommen ist, und zu planen, dass es nächstes Jahr aufs College geht. Diese Branche bewegt sich so schnell, dass es zur Tatsache wird, dass alle sechs Monate der Nutzer derjenige ist, der es "falsch hält".
- jryan49
Ich habe es gerade am Wochenende getestet und hatte eine 33-stündige Claude-Session völlig unbeaufsichtigt, mit minimalem Prompting. Alles, was es generiert hat, sieht auch gut aus. Es ist verrückt.
- silversmith
"Die Biology-Safeguards sind dieselben wie bei Claude Fable 5.1 ... Alltägliche Gesundheits- und Bildungsfragen sind nicht betroffen"
Und trotzdem sind wir hier: "warum meine Waden nach dem Training mehr schmerzen als jeder andere Muskel" wird als unanständige Frage eingestuft.
- bob1029
> Viertens: Wenn lange Tool-Calling-Turns länger still bleiben, als dir lieb ist, lass dein Harness nach einem Update fragen
Ich bin mir nicht sicher, ob ich diese Komplexität verstehe. In allen Harnesses, die ich je benutzt habe, werden die Tool-Calls selbst dem Nutzer als Fortschrittsanzeige präsentiert. Wenn das UI/UX drumherum gut gemacht ist, sollte der Nutzer ungefähr ableiten können, was vor sich geht. Verschiedene Tools haben unterschiedliche ideale Darstellungen. Man kann nicht alles auf Plaintext-Blobs reduzieren.
Wenn ich unbedingt Fortschritts-Updates innerhalb eines Turns bräuchte, würde ich ein separates Transkript pro Turn ansammeln und es in deterministischen Intervallen in ein günstigeres Modell einspeisen.
- bronlund
Das Erste, was es tat, als ich es ausprobierte, war, durch Dateien in Verzeichnissen weit außerhalb des Projekts zu streifen. Ich habe mehrfach versucht, es dazu zu bringen, zu erklären, warum es das tat, aber ich habe nie etwas bekommen, das einer Erklärung nahekommt.
- _superposition_
Anthropic ist das neue Microsoft.
Nur so mein Bauchgefühl. Ich werde mich von ihren Produkten fernhalten. Hoffentlich wird es meiner Karriere genauso zugutekommen, indem ich mich auf offene Standards konzentriere, statt auf irgendeinen proprietären Bullshit, der sich alle drei Monate ändert.