Claude Sonnet 5.5: Schneller und sparsamer zum gleichen Preis, aber nicht ohne Umbau
Anthropic hat Claude Sonnet 5.5 freigegeben: Preise wie bei Sonnet 5, über 30 Prozent schnellere Ausgabe und fünf Änderungen, die bestehenden Code brechen.
Anthropic hat am 28. September 2026 Claude Sonnet 5.5 veröffentlicht, knapp eine Woche nach Claude Opus 5.5. Es ist das zweite Modell der 5.5-Reihe und löst Claude Sonnet 5 als Mittelklassemodell ab. Verfügbar ist es ab sofort über die Claude API unter der Modell-ID claude-sonnet-5-5 sowie über Amazon Bedrock, Claude Platform on AWS, Google Cloud und Microsoft Foundry. Claude Haiku 5.5 soll laut Anthropic in den kommenden Wochen folgen.
Die Eckdaten entsprechen denen von Opus 5.5: ein Kontextfenster von einer Million Token, bis zu 128.000 Token Ausgabe, Wissensstand Juni 2026. Der Tokenizer ist derselbe wie bei Sonnet 5, Token-Zählungen bleiben also vergleichbar. Anthropic sagt zu, das Modell frühestens am 28. September 2027 abzuschalten.
Gleicher Preis, weniger Verbrauch
Anders als bei Opus 5.5 sinken die Listenpreise nicht. Eingabe kostet weiter 2 US-Dollar je Million Token, Ausgabe 10 US-Dollar. Cache-Reads liegen bei 0,20 US-Dollar, das Schreiben in den Cache bei 2,50 US-Dollar für fünf Minuten und 4 US-Dollar für eine Stunde. Über die Batch-API gibt es wie bisher 50 Prozent Nachlass. Opus 5.5 kostet zum Vergleich genau das Doppelte, 4 und 20 US-Dollar.
Die Ersparnis soll über den Verbrauch kommen. Nach Anthropics Angaben erzeugt Sonnet 5.5 Ausgaben mehr als 30 Prozent schneller als Sonnet 5 und kostet je erledigter Aufgabe bis zu 30 Prozent weniger, weil es für dieselbe Arbeit weniger Token und weniger Tool-Aufrufe braucht. Mehrere Kunden, die das Modell vorab getestet haben, berichten in dieselbe Richtung: Slack nennt rund 14 Prozent weniger Ausgabe-Token ohne geänderte Prompts, Lovable ein Drittel weniger Tool-Aufrufe, Zendesk eine um 20 Prozent schnellere Bearbeitung von Support-Tickets.
Bei 2.441 Finanzaufgaben lag Claude Sonnet 5.5 vor Sonnet 5 und brauchte im Schnitt rund 121.000 Token pro Antwort, Sonnet 5 dagegen 497.000.
So beschreibt Joe Poirier vom Vermögensverwalter Balyasny Asset Management die Tests seines Hauses. Solche Zahlen stammen aus Anthropics Ankündigung und sind von den Kunden selbst gemessen, nicht unabhängig geprüft.

Nah an Opus 5.5, bei einem Test sogar vorn
In Anthropics eigenen Messungen rückt Sonnet 5.5 dicht an das teurere Opus 5.5 heran. Beim Bedienen von Rechnern (OSWorld 2.1) erreicht es 80,1 Prozent gegenüber 81,8 Prozent bei Opus 5.5 und 57,0 Prozent bei Sonnet 5. Bei Wissensarbeit nach GDPval-AA liegen beide praktisch gleichauf, 1.844 zu 1.846 Punkte. Auf Terminal-Bench 4.0, einem Test für agentisches Programmieren, liegt Sonnet 5.5 mit 70,6 Prozent sogar vor Opus 5.5 mit 66,4 Prozent. Bei FrontierCode 1.1 bleibt der Abstand deutlicher: 46,2 Prozent gegenüber 54,4 Prozent.
Auch hier gilt: Die Werte kommen vom Hersteller. Anthropic betont selbst, dass Sonnet 5.5 die Leistungsgrenze der eigenen Modelle nicht verschiebt. Es bringt den Stand von Opus 5.5 in eine günstigere und schnellere Klasse.
Fünf Änderungen brechen bestehenden Code
Wer heute claude-sonnet-5 aufruft, kommt mit dem Austausch der Modell-ID nicht in jedem Fall durch. Die Liste ähnelt der von Opus 5.5.
Denken lässt sich nicht mehr mit disabled abschalten, das führt zu einem Fehler 400. Die niedrigste Stufe heißt jetzt between_tools: Das Modell überlegt nicht vorab, schreibt aber zwischen Tool-Aufrufen kurze Zwischenstände. Diese Stufe funktioniert nur bis zum Effort high. Feste Denkbudgets und von der Voreinstellung abweichende Werte für temperature, top_p oder top_k werden ebenfalls abgewiesen.
Erzwungene Tool-Aufrufe mit tool_choice vom Typ any oder tool gibt es nicht mehr. Anthropic verweist auf auto zusammen mit strikten Tool-Definitionen oder auf Structured Outputs.
Thinking-Blöcke sind an Modell, Konversation und Konto gebunden. Sonnet 5.5 liest die Denkblöcke von Sonnet 5, aber kein anderes Modell liest die von Sonnet 5.5. Wird der Verlauf nachträglich bearbeitet, etwa der Systemprompt oder eine frühere Nachricht, lehnt die API bei Konten ab dem 31. August 2026 die Anfrage ab.
Computer Use läuft über die Claude API und Google Cloud nur noch mit dem Toolset computer_toolset_20260801, auf Amazon Bedrock wird das ältere Werkzeug weiter angenommen. Und beim Advisor-Werkzeug (Beta) werden Opus 4.8, Opus 4.7 und Sonnet 5 nicht mehr als Berater akzeptiert.
Hinzu kommt eine stille Änderung: Text zwischen zwei Tool-Aufrufen kommt als Thinking-Block zurück und ist in der Voreinstellung leer. Anwendungen, die diese Zwischenmeldungen anzeigen, werden ohne Anpassung stumm, ohne dass ein Fehler auftritt.
Voreinstellung und Schutzfilter
Beim Effort geht Anthropic einen anderen Weg als bei Opus 5.5. Über die API ist Sonnet 5.5 auf high voreingestellt, in Claude Code und den Claude-Apps laut VentureBeat auf medium. Die Stufen sind zudem neu kalibriert und liefern nicht mehr denselben Denkaufwand wie bei Sonnet 5. Anthropic rät, die passende Stufe neu auszumessen, statt den alten Wert zu übernehmen.
Neu für ein Sonnet-Modell sind die Schutzmechanismen, die bisher den Spitzenmodellen vorbehalten waren. Die Fähigkeiten in der Cybersicherheit liegen nach Anthropics Einschätzung etwa auf dem Niveau von Opus 5. Anfragen mit höherem Risiko in diesem Bereich lehnt das Modell ab, sie lassen sich auf Sonnet 5 umleiten. Außerdem blockieren Klassifikatoren Versuche, die interne Argumentation des Modells auszulesen. Abgelehnte Anfragen kommen mit HTTP 200 und dem Stop-Grund refusal samt Kategorie zurück.
Was das für Ihr Unternehmen heißt
- Wer Sonnet 5 produktiv einsetzt, bekommt beim gleichen Listenpreis ein schnelleres Modell, das pro Aufgabe weniger Token verbraucht. Die tatsächliche Ersparnis zeigt erst ein Test mit eigenen Aufgaben.
- Für viele Aufgaben, die bisher Opus brauchten, ist Sonnet 5.5 einen Versuch wert. Es kostet die Hälfte und liegt in mehreren Tests nur knapp dahinter.
- Vor dem Wechsel gehören auf die Prüfliste: abgeschaltetes Denken, erzwungene Tool-Aufrufe, Sampling-Parameter, bearbeitete Gesprächsverläufe, Computer Use und das Advisor-Werkzeug.
- Wer Zwischenmeldungen des Agenten an Nutzer weitergibt, muss die Anzeige ausdrücklich einschalten, sonst bleibt die Oberfläche zwischen Tool-Aufrufen still.
- Den Effort sollte man bewusst setzen und neu testen. Übernommene Werte von Sonnet 5 führen zu anderem Verhalten.