Claude Haiku 5.5 kostet ein Zehntel: Was Unternehmen vor dem Wechsel wissen müssen
Anthropic hat Claude Haiku 5.5 freigegeben: 0,10 statt 1 US-Dollar je Million Eingabe-Token, eine Million Token Kontext und deutlich bessere Werte. Dazu kommen ein neuer Tokenizer und Änderungen, die bestehenden Code brechen.
Anthropic hat am 7. Oktober 2026 Claude Haiku 5.5 veröffentlicht. Nach Claude Opus 5.5 am 22. September und Claude Sonnet 5.5 am 28. September ist es das dritte und kleinste Modell der 5.5-Reihe. Einen Haiku 5 hat es nie gegeben, das neue Modell folgt direkt auf Claude Haiku 4.5 aus dem Oktober 2025.
Verfügbar ist es ab sofort über die Claude API unter der Modell-ID claude-haiku-5-5 sowie über Amazon Bedrock, Claude Platform on AWS, Google Cloud und Microsoft Foundry. Anthropic sagt zu, das Modell frühestens am 7. Oktober 2027 abzuschalten.
Der Preis ist die eigentliche Nachricht
Haiku 4.5 kostete 1 US-Dollar je Million Eingabe-Token und 5 US-Dollar je Million Ausgabe-Token. Haiku 5.5 liegt bei 0,10 und 0,50 US-Dollar, also bei einem Zehntel. Das gilt für Anfragen bis 100.000 Token. Darüber steigt der Preis auf 0,50 und 2,50 US-Dollar, das ist immer noch die Hälfte des alten Preises. Cache-Reads kosten 0,01 US-Dollar je Million Token, die Batch-API gibt wie üblich 50 Prozent Nachlass.
Anthropic fasst das so zusammen: Im Schnitt koste der Betrieb rund 75 Prozent weniger. Dahinter steckt ein Haken, den man kennen sollte. Haiku 5.5 nutzt den neueren Tokenizer, den auch Opus 5.5 und Sonnet 5.5 verwenden. Derselbe Text zählt damit rund 30 Prozent mehr Token als bei Haiku 4.5. Außerdem denkt das Modell jetzt mit, und auch diese Denk-Token werden als Ausgabe berechnet.
Eine grobe Rechnung für einen typischen Fall: 100.000 Anfragen im Monat, etwa zum Einsortieren eingehender E-Mails, mit je 2.000 Token Eingabe und 300 Token Antwort (gezählt mit Haiku 4.5). Mit Haiku 4.5 kostet das rund 350 US-Dollar. Mit Haiku 5.5 sind es inklusive der 30 Prozent Token-Aufschlag rund 46 US-Dollar, zuzüglich der Denk-Token. Selbst wenn sich die Ausgabe dadurch verdoppelt, bleibt die Rechnung bei einem Bruchteil des alten Betrags.

Ein kleines Modell, das plötzlich mehr kann
Haiku war bisher das Modell für einfache Massenarbeit: Texte einordnen, Daten aus Dokumenten ziehen, Anfragen weiterleiten. Dafür ist auch Haiku 5.5 gedacht. Anthropic nennt Zusammenfassungen, Datenbankabfragen, Klassifizierung und schnellen Kundensupport sowie den Einsatz als Unteragent, dem ein größeres Modell Teilaufgaben übergibt.
In Anthropics eigenen Messungen ist der Sprung groß. Beim Bedienen von Rechnern (OSWorld 2.1) steigt der Wert von 15,7 auf 72,4 Prozent, bei Wissensarbeit nach GDPval-AA von 735 auf 1.620 Punkte. Auf Terminal-Bench 4.0, einem Test für agentisches Programmieren, kam Haiku 4.5 auf null Prozent, Haiku 5.5 auf 39,2 Prozent. Sonnet 5.5 liegt in allen Tests weiter klar vorn, etwa mit 83,9 Prozent bei OSWorld. Die Werte stammen vom Hersteller und sind nicht unabhängig geprüft.
Claude Haiku 5.5 erreichte 11 Punkte mehr als Haiku 4.5, bei etwa der halben Latenz.
So beschreibt Yashodha Bhavnani vom Cloudspeicher-Anbieter Box die eigenen Tests. Asana berichtet in der Ankündigung von über 30 Prozent weniger Wartezeit, HubSpot von 92,8 Prozent in seiner CRM-Testreihe.
Neu ist auch der Rahmen: Haiku 5.5 verarbeitet bis zu eine Million Token Kontext und schreibt bis zu 128.000 Token Ausgabe. Es versteht Text und Bilder, antwortet aber nur in Text. Über die Claude API und Google Cloud beherrscht es zusätzlich das Browser-Werkzeug von Anthropic, das Haiku 4.5 nicht unterstützte. Der Wissensstand reicht bis Juni 2026.
Austausch der Modell-ID reicht nicht
Wer heute claude-haiku-4-5 aufruft, muss mehr ändern als den Namen. Anthropics Migrationsleitfaden listet zehn Punkte, die wichtigsten für den Alltag:
Das Denken lässt sich nicht mehr mit einem festen Token-Budget steuern, das führt zu einem Fehler 400. Stattdessen entscheidet das Modell selbst, wie viel es nachdenkt, gelenkt über die Stufe effort, die auf medium voreingestellt ist. Wer Haiku 4.5 ohne Denken betrieben hat, um Kosten zu sparen, sollte eine niedrigere Stufe wählen. Weil Denk-Token auf max_tokens angerechnet werden, kann eine knapp bemessene Grenze dazu führen, dass gar keine Antwort mehr kommt.
Die Parameter temperature, top_p und top_k werden mit abweichenden Werten abgewiesen. Gerade bei Klassifizierungen wurde oft mit temperature: 0 gearbeitet, das geht nicht mehr. Ebenso fällt das sogenannte Prefill weg, bei dem man die Antwort des Modells anfängt, etwa mit einer geöffneten JSON-Klammer. Anthropic verweist für feste Ausgabeformate auf Structured Outputs oder auf Werkzeuge mit vorgegebenen Werten.
Dazu kommen Regeln, die vor allem Anbieter mit eigenen Plattformen betreffen: Denkblöcke funktionieren nur im Konto, das sie erzeugt hat, und Gesprächsverläufe dürfen nachträglich nicht verändert werden. Das Modell kann Anfragen über Sicherheitsfilter ablehnen, darauf muss die Anwendung reagieren. Und wer bei Haiku 4.5 eine Priority-Tier-Zusage hat, muss neu planen: Für Haiku 5.5 gibt es diese Stufe nicht.
Was das für Ihr Unternehmen heißt
- Alles, was heute in großen Mengen über ein kleines Modell läuft, wird deutlich günstiger: Mail-Sortierung, Belegerkennung, Ticket-Vorsortierung, Zusammenfassungen. Bei vielen Anwendungen sinken die Modellkosten auf einen Bruchteil.
- Kostenrechnungen neu aufstellen. Der neue Tokenizer zählt rund 30 Prozent mehr, dazu kommen Denk-Token und der doppelte Preis ab 100.000 Token je Anfrage. Wer lange Dokumente am Stück verarbeitet, spart weniger als die Schlagzeile verspricht.
- Aufgaben, die bisher Sonnet brauchten, lohnt ein Test mit Haiku 5.5. Sonnet 5.5 kostet das Zwanzigfache, und für viele Routineaufgaben reicht das kleine Modell inzwischen.
- Vor dem Umstieg gehören auf die Prüfliste: Denkbudgets,
temperatureund Co., Prefills,max_tokens-Grenzen, Computer Use und der Umgang mit Ablehnungen. - Für den Datenschutz ändert sich wenig: Wie bei den anderen Modellen laufen Verträge in der EU über Anthropic Ireland. Wer einen festen Datenstandort braucht, schaut auf die regionalen Endpunkte bei Amazon Bedrock oder Google Cloud.
Fazit
Mit Haiku 5.5 wird KI-Automatisierung für Massenaufgaben noch einmal spürbar billiger, und das kleine Modell kommt in Bereiche, die bisher den größeren vorbehalten waren. Den vollen Vorteil gibt es aber erst nach einem sauberen Umbau und einer ehrlichen Nachrechnung mit eigenen Daten. Wenn Sie wissen möchten, was Haiku 5.5 bei Ihren Abläufen konkret spart oder wo sich eine Automatisierung jetzt erstmals rechnet, sprechen Sie mich gern an.