Claude Haiku 5.5: 75 % günstiger und schneller als je zuvor
Anthropic hat Claude Haiku 5.5 vorgestellt – sein schnellstes und günstigstes Small Model. Es kostet im Schnitt 75 % weniger als Haiku 4.5 und eignet sich für Massenaufgaben wie Zusammenfassungen, Klassifikationen und Subagenten. In Benchmarks wie OSWorld 2.1 erreicht es 72,4 % (Haiku 4.5: 15,7 %). Zudem senkt Anthropic die Cache-Read-Preise für Sonnet 5.5 und führt monatliche API-Guthaben für Max- und Team-Abonnenten ein.
Wir sind sehr beeindruckt von Claude Haiku 5.5, besonders von seiner Geschwindigkeit. Im Vergleich zum aktuell verwendeten Modell sahen wir eine Reduzierung der Latenz bei Aufgabenabschlüssen um über 30 % und bis zu 2,5-mal schnellere Inferenz pro Agent-Turn. Es ist eine spürbar flottere Erfahrung.
- simonw
Pelikane, die auf Fahrrädern fahren, für Haiku auf den verschiedenen Thinking-Stufen: https://tools.simonwillison.net/markdown-svg-renderer?url=ht...
Low verhaut den Fahrradrahmen, aber medium/high/xhigh/max bekommen den Fahrradrahmen alle richtig hin.
Der max-Durchlauf brauchte 5 Minuten 9 Sekunden und kostete 3,3826 Cent. Der günstigste (low) kostete 0,0936 Cent und brauchte 7 Sekunden.
Die neueste Version meines llm-anthropic-Plugins fragt die Anthropic-Modell-Listing-API direkt ab, also musste ich das Plugin nicht upgraden, um Unterstützung für dieses Modell hinzuzufügen:
llm install llm-anthropic -U
llm anthropic refresh
llm -m claude-haiku-5.5 'prompt goes here'
EDIT: Hier ist der Haiku-4.5-Pelikan von vor einem Jahr zum Vergleich, der war furchtbar: https://simonwillison.net/2025/Oct/15/claude-haiku-45/
- minimaxir
Die Preisgestaltung ist ... ein bisschen seltsam.
Input
$0.10 / MTok für Prompts bis zu 100.000 Tokens
$0.50 / MTok für Prompts über 100.000 Tokens
Output
$0.50 / MTok für Prompts bis zu 100.000 Tokens
$2.50 / MTok für Prompts über 100.000 Tokens
100k Tokens ist eine absurd niedrige Grenze, und sie gilt nur für Haiku und nicht für Sonnet oder Opus. Die Grenze ist niedrig genug, dass sie schnell überschritten wird, wenn man irgendetwas mit Agents macht; für typische Generierung oder Jev-artige Klassifikatoren ist es ein guter Preis, und wie im Artikel erwähnt, ist das offenbar die überwiegende Mehrheit der Haiku-Nutzung.
In beiden Fällen immer noch viel günstiger als Haiku 4.5 mit $1 Input / $5 Output, und diese Preise konkurrieren besser mit GPT-6 Luna. ($0.10 Input / $0.50 Output, aber ohne Token-Schwelle [EDIT: die Schwelle für Luna liegt offenbar bei 272k])
- charlesabarnes
> Zweitens werden wir diese Woche ein neues monatliches API-Guthaben für alle Max- und Team-Abonnenten einführen, das auf der Claude Platform verwendet werden kann. Max-5x-Nutzer erhalten $100 Guthaben pro Monat, Max-20x-Nutzer erhalten $200, und Team-Abonnenten erhalten bis zu $500, gepoolt über ihre Nutzer
Das ist ein sehr großer Vorteil für mich. Ich kann jetzt echte KI-verbesserte Features hinter meinem Abo ausliefern, ohne extra zu zahlen oder mich vollständig auf On-Device-Modelle zu verlassen. Ich mache mir allerdings Sorgen, dass das nur dazu dient, die Wucht nutzerunfreundlicher Änderungen abzumildern
- chriddyp
Habe unseren DataAnalyticsBench-Benchmark darauf laufen lassen: https://plotly.com/blog/claude-haiku-5-5-plotly-data-analyti...
9x günstiger als Haiku 4.5 und zwei Notenstufen besser. Es ist außerdem jetzt das schnellste Modell (mit den Standardgeschwindigkeiten, ohne den "Fast"-Modus der anderen Modelle zu versuchen), um die Prüfung abzuschließen.
Ähnliche Größenordnung wie Luna bei Preis, Kosten und Genauigkeit. Das sind sehr billige Modelle: $0.38, um 40 ausführliche Data-Analytics-Fragen zu beantworten (im Vergleich zu $15 für Opus 5.5 oder $20 für Astra).
Insgesamt sehr gut in Datenanalyse – bewältigt alle geradlinigen Data-Analytics-Fragen korrekt. Es hat bei einigen Fragen versagt, die eine tiefergehende statistische Analyse erforderten, etwa das Untersuchen anderer Variablen. Mit anderen Worten: Es ist in seiner Analyse nicht so hartnäckig wie andere Modelle, was man angesichts der Positionierung des Modells wohl erwarten würde.
Im Vergleich zu OpenAI: GPT-6 Luna war etwas besser und kostete etwa 30 % von Haiku 5.5. GPT-6.1 Sol beantwortete alle Fragen korrekt, war aber 10x teurer.
- simonw
Meine Beschwerde über Haiku 4.5 war, dass es 10x so teuer war wie GPT-6 Luna.
> Claude Haiku 5.5 ist 90 % günstiger als Claude Haiku 4.5 für Anfragen bis zu 100.000 Tokens und 50 % günstiger für Anfragen über 100.000 Tokens
Haiku und Luna haben jetzt exakt denselben Preis bis zu 100.000 Tokens. Luna ist jetzt günstiger für alles über 100.000 Tokens, selbst nach Lunas eigenen Preiserhöhungen bei 270.000 ist es immer noch weniger als Haiku.
Es klingt also, als hätten sie genau dieses Problem direkt angegangen. Ihre selbst gemeldeten Benchmarks sind auch alle höher als die von Luna.
- jjcm
Habe Image -> HTML-Tests dafür laufen lassen. Ich war neugierig, ob dieses kleinere Modell gut genug für komplexe UI ist. War es nicht.
Haiku 5.5: https://html.non.io/lcars-haiku-5.5/
Opus 5.5 zum Vergleich: https://html.non.io/lcars-opus-5.5
Designs, von denen es gebaut hat: https://diffui.ai/app/canvas/5093e689-1e74-4f26-b632-2a4500f...
Eine interessante Sache ist, dass es sich die Aufgabe angesehen und sie sofort an Opus 5.5 delegiert hat. Es weiß zumindest, worin es nicht gut ist. Aber sehr schnell, und wahrscheinlich am besten für kleine Subagent-Aufgaben / eng umrissene Arbeit geeignet.
- seaal
Die monatlichen API-Guthaben für den Max-Plan klingen fantastisch, besonders angesichts der Haiku-Preise. Meinen Claude-Plan tatsächlich für andere Harnesses und Use-Cases zusätzlich zur normalen CC-Nutzung verwenden zu können, ist alles, was ich wollte.
Anthropic hat in den letzten Wochen wirklich alles richtig gemacht, während OpenAI weiter den Ball fallen lässt.
- wyrdcurt
Endlich hat Anthropic ein konkurrenzfähiges günstiges Modell veröffentlicht. Haiku 4.5 war jetzt monatelang zu teuer für seine Leistung (tatsächlich erinnere ich mich nicht, dass ich sonderlich beeindruckt war, selbst als es herauskam). Dieses hier sieht tatsächlich so aus, als wäre es in manchen Szenarien die Nutzung wert. Wenn es wirklich so ein großer Sprung gegenüber Luna ist, wie die gezeigten Benchmarks andeuten, wird es Luna wahrscheinlich in meinen Workflows ersetzen. 100k Tokens ist eine ziemlich niedrige Schwelle, bevor der Preis steigt, aber ich nutze diese kleineren Modelle ohnehin eher für kleinere Aufgaben.
- bouk
Das ist großartig! Habe GPT 6 Luna zum Decompilen meines Lieblingsspiels aus der Kindheit (Age of Mythology) benutzt, und das bedeutet, dass ich Haiku jetzt auch mit ins Spiel bringen kann. Bisher 17352/21965 Funktionen gematcht ...
- d1l
Bei der Arbeit nutzen wir Haiku 4.5 für eine Handvoll latenzempfindlicher Aufgaben, die ziemlich einfach sind. Es funktioniert gut. Habe gerade angefangen, 5.5 zu testen, weil ich seit dem Teaser eine schöne Verbesserung erwartet habe. Die bisherigen Ergebnisse sind Müll. Sogar Prompt-Leakage. Und es ist langsamer. Ich schätze, es ist billig, aber ich denke, sie haben bei diesem Modell die Balance falsch hinbekommen.