Claude Sonnet 5.5: Schneller und günstiger, aber mit Breaking Changes in der API
Anthropic hat am 28. September 2026 Claude Sonnet 5.5 veröffentlicht. Der Tokenpreis bleibt bei 2 und 10 US-Dollar pro Million Tokens, das Modell soll über 30 Prozent schneller und pro Aufgabe bis zu 30 Prozent günstiger sein. Für API-Nutzer bringt es fünf Breaking Changes, darunter 400-Fehler bei abgeschaltetem Thinking und erzwungener Tool-Nutzung.

Anthropic hat am 28. September 2026 Claude Sonnet 5.5 veröffentlicht. Relevant ist das für alle, die Claude über die API, Amazon Bedrock, Google Cloud oder Microsoft Foundry in eigene Anwendungen, Agenten oder Automatisierungen eingebunden haben, sowie für Teams, die Claude Code oder die Claude-Apps im Alltag nutzen. Der Tokenpreis bleibt bei 2 US-Dollar pro Million Eingabetokens und 10 US-Dollar pro Million Ausgabetokens, das Modell soll aber laut Anthropic über 30 Prozent schneller antworten und pro Aufgabe bis zu 30 Prozent günstiger sein, weil es weniger Tokens verbraucht.
Wer Claude nur im Browser nutzt, muss heute nichts tun. Wer dagegen Integrationen betreibt, sollte den Wechsel nicht einfach per Modell-ID erledigen: Die offizielle Dokumentation nennt fünf Breaking Changes gegenüber Claude Sonnet 5, darunter HTTP-400-Fehler bei abgeschaltetem Thinking und bei erzwungener Tool-Nutzung. Ein akuter Handlungsdruck besteht nicht, Sonnet 5 bleibt als Legacy-Modell verfügbar. Der Umstieg gehört aber in ein geplantes Testfenster.
Was ist passiert?
Sonnet 5.5 ist nach Claude Opus 5.5 das zweite Modell der Claude-5.5-Familie. Anthropic positioniert es als schnellere und günstigere Ergänzung zu Opus 5.5: gedacht für klar abgegrenzte Alltagsaufgaben, Fehlerbehebung im Code sowie das Erstellen von Dokumenten, Präsentationen und Tabellen. Ein kleineres Modell Claude Haiku 5.5 hat Anthropic für die kommenden Wochen angekündigt, ein konkretes Datum nennt der Hersteller nicht.
Die Eckdaten laut offizieller Modellseite von Anthropic:
- API-Modell-ID
claude-sonnet-5-5, auf Amazon Bedrockanthropic.claude-sonnet-5-5 - Kontextfenster 1 Million Tokens, maximale synchrone Ausgabe 128.000 Tokens, über die Batch-API mit Beta-Header bis 300.000 Tokens
- Preise pro Million Tokens: 2 US-Dollar Eingabe, 10 US-Dollar Ausgabe, 0,20 US-Dollar Cache-Read, 2,50 US-Dollar für 5-Minuten-Cache-Writes und 4 US-Dollar für 1-Stunden-Cache-Writes, Batch-API mit 50 Prozent Rabatt
- Wissensstand laut Anthropic bis Juni 2026
- Adaptive Thinking standardmäßig aktiv, Standard-Effort auf der Claude-API ist
high, in Claude Code und den Appsmedium - derselbe Tokenizer wie Sonnet 5, gleiche Texte ergeben also gleiche Tokenzahlen
Zum Vergleich mit dem Vorgänger: Für Sonnet 5 hatte Anthropic im Juli die Preise von 2 und 10 US-Dollar nur als Einführungspreis bis 31. August 2026 angekündigt. Laut der aktuellen Preisseite ist dieser Preis inzwischen der Standardpreis, die geplante Erhöhung auf 3 und 15 US-Dollar findet nicht statt. Sonnet 5 und Sonnet 5.5 kosten pro Token damit exakt gleich. Die Ersparnis entsteht nur, wenn das neue Modell für dieselbe Aufgabe tatsächlich weniger Tokens braucht.
Bei den Benchmarks nennt Anthropic deutliche Sprünge. Alle folgenden Werte sind Herstellerangaben aus der Ankündigung und nicht unabhängig nachgeprüft:
- Terminal-Bench 4.0 (agentisches Arbeiten auf der Kommandozeile): 70,6 Prozent gegenüber 10,3 Prozent bei Sonnet 5 und 66,4 Prozent bei Opus 5.5 (Effort Xhigh)
- CursorBench 4.0: 55,5 Prozent gegenüber 34,1 Prozent bei Sonnet 5 und 57,8 Prozent bei Opus 5.5
- OSWorld 2.1 (Computerbedienung): 80,1 Prozent gegenüber 57,0 Prozent bei Sonnet 5 und 81,8 Prozent bei Opus 5.5
- GDPval-AA v2.1 (Wissensarbeit, von Artificial Analysis gemessen): 1844 Elo gegenüber 1449 bei Sonnet 5 und 1846 bei Opus 5.5
Anthropic schränkt selbst ein, dass Opus 5.5 bei komplexer, offener Arbeit mit anhaltendem Urteilsvermögen klar stärker bleibe. Auf maximalem Effort erreiche Sonnet 5.5 zwar teils Opus-Niveau, dann aber auch zu ähnlichen Kosten pro Aufgabe. heise online und THE DECODER haben die Ankündigung am selben Abend aufgegriffen und bestätigen Preise, Verfügbarkeit und die Kernaussagen.
Für wen ist das relevant?
Direkt relevant ist Sonnet 5.5 für Unternehmen, die Claude programmatisch nutzen. Verfügbar ist es laut Dokumentation auf der Claude-API für alle Kunden, auf Amazon Bedrock, auf der Claude Platform on AWS, auf Google Cloud und in Microsoft Foundry. Wie bei Opus 5.5 und Sonnet 5 bietet Anthropic das Modell auch mit Zero Data Retention an.
- Entwicklungsteams mit Claude Code oder eigenen Coding-Agenten: Hier liegt laut Anthropic der größte Leistungssprung.
- Betreiber von Support-, Ticket- oder Dokumentenautomatisierung mit hohem Tokenvolumen: Weniger Tokens pro Aufgabe wirken direkt auf die Rechnung.
- Teams, die Computer Use einsetzen: Auf der Claude-API und Google Cloud wird das alte Werkzeug
computer_20251124nicht mehr akzeptiert. - Anwendungen, die Unterhaltungen nachträglich bearbeiten oder zwischen Konten verschieben: Thinking-Blöcke sind an Modell, Konversation und Konto gebunden.
Weniger betroffen sind reine Chat-Nutzer in den Claude-Apps, bei denen Anthropic die Modellauswahl verwaltet, sowie Umgebungen, die Claude nur über ein Drittprodukt nutzen. Dort hängt der Wechsel davon ab, wann der jeweilige Anbieter umstellt.
Wie kritisch ist das?
Sicherheitskritisch ist die Meldung nicht, es handelt sich um eine Produktneuerung. Betrieblich relevant sind die Inkompatibilitäten, weil sie nicht still scheitern, sondern Anfragen mit HTTP 400 abweisen. Die fünf Breaking Changes laut Anthropic-Dokumentation:
thinking: {"type": "disabled"}liefert einen 400-Fehler. Wer Thinking abschalten will, mussbetween_toolssenden, das nur bei den Effort-Stufen low, medium und high funktioniert.- Erzwungene Tool-Nutzung per
tool_choicemitanyodertoolwird abgelehnt. Erlaubt sind nur nochautoundnone, als Ersatz empfiehlt Anthropic Strict Tool Use oder Structured Outputs. - Thinking-Blöcke sind an das erzeugende Modell und die Konversation gebunden. Bei Konten, die ab dem 31. August 2026 angelegt wurden, führt eine nachträgliche Änderung am Verlauf vor einem solchen Block standardmäßig zu einem 400-Fehler.
- Auf der Claude-API und Google Cloud wird Computer Use nur noch über
computer_toolset_20260801unterstützt. Amazon Bedrock akzeptiert das ältere Werkzeug weiterhin. - Das Advisor-Tool (Beta) akzeptiert Opus 4.8, Opus 4.7 und Sonnet 5 nicht mehr als Berater für Sonnet 5.5.
Hinzu kommt eine stille Verhaltensänderung: Längere Zwischentexte zwischen Tool-Aufrufen kommen als Thinking-Blöcke zurück und sind im Standard leer. Eine Oberfläche, die diese Zwischenstände anzeigt, bleibt dann ohne Fehlermeldung stumm. Außerdem sind die Effort-Stufen neu kalibriert, ein von Sonnet 5 übernommener Wert erzeugt nicht dieselbe Denktiefe.
Neu sind auch Sicherheitsfilter. Weil die Cyberfähigkeiten von Sonnet 5.5 laut Anthropic mit denen von Opus 5 vergleichbar sind, werden riskante Cybersecurity-Anfragen abgefangen und sichtbar an Sonnet 5 weitergereicht. Routinemäßige Softwareentwicklung und Fehlerbehebung sollen unberührt bleiben. Laut heise räumt Anthropic ein, dass Filter gelegentlich auch legitime Anfragen blockieren können. Abgelehnte Anfragen kommen mit HTTP 200 und stop_reason: "refusal" zurück, was Monitoring ohne eigene Auswertung leicht übersieht.
Was sollten Admins jetzt tun?
- Inventar erstellen: Alle Stellen suchen, an denen
claude-sonnet-5oderanthropic.claude-sonnet-5fest im Code, in Umgebungsvariablen, in LLM-Gateways oder in Automatisierungsplattformen hinterlegt ist, und die jeweilige Plattform (Claude-API, Bedrock, Google Cloud, Foundry) notieren. - Code nach
"disabled"im Thinking-Parameter und nachtool_choicemitanyodertooldurchsuchen. Diese Stellen brechen mit Sonnet 5.5 sicher. - Prüfen, ob Anwendungen Gesprächsverläufe nachträglich ändern, kürzen oder zwischen Konten übertragen. Solche Muster auf reines Anhängen umstellen oder Thinking-Blöcke gezielt entfernen.
- Computer-Use-Integrationen auf Claude-API und Google Cloud auf
computer_toolset_20260801migrieren, bevor das Modell getauscht wird. - Den Umstieg zuerst in einer Testumgebung mit echten Aufgaben durchführen und Tokenverbrauch, Laufzeit und Ergebnisqualität gegen Sonnet 5 messen. Die angegebene Ersparnis von bis zu 30 Prozent ist ein Herstellerwert, die eigene Last kann abweichen.
- Effort-Einstellungen neu testen statt übernehmen. Anthropic empfiehlt für agentisches Coding den Start bei
mediumund für Chat beimediumoderlow. - Refusal-Behandlung einbauen:
stop_reason: "refusal"undstop_detailsauswerten und im Monitoring sichtbar machen, besonders wenn Sicherheitsteams Claude für Analysearbeit nutzen. - Zentrale Modellsteuerung prüfen. Wer ein Gateway wie LiteLLM betreibt, kann Sonnet 5.5 zunächst nur für ausgewählte Teams freischalten und bei Problemen auf Sonnet 5 zurückschalten.
- Budgets und Rate Limits anpassen: Der Tokenpreis bleibt gleich, Ablehnungen zählen laut Dokumentation aber gegen die Rate Limits.
Einordnung für Unternehmen
Für kleine und mittlere Unternehmen ist Sonnet 5.5 vor allem eine Kostenfrage. Wer Claude für Dokumentenerstellung, Support-Entwürfe oder Coding einsetzt, bekommt laut Anthropic mehr Leistung zum gleichen Tokenpreis. Ob die Rechnung tatsächlich sinkt, zeigt erst ein Vergleich mit den eigenen Aufgaben, denn die Herstellerbenchmarks messen spezielle Szenarien. Die von Anthropic veröffentlichten Kundenstimmen, etwa von Slack mit rund 14 Prozent weniger Ausgabetokens, sind ebenfalls Einzelwerte ohne unabhängige Prüfung.
Für den Betrieb ist die Liste der Breaking Changes wichtiger als die Benchmarks. Die Richtung ist bei Anthropic seit mehreren Modellgenerationen gleich: Thinking lässt sich nicht mehr frei abschalten, Thinking-Blöcke werden fester an Konto und Verlauf gebunden, ältere Tool-Versionen fallen weg. Wer Modell-IDs zentral verwaltet, Integrationstests mit echten Anfragen fährt und Ablehnungen protokolliert, kann solche Wechsel in einem normalen Wartungsfenster erledigen. Wer die Modell-ID in vielen Skripten fest verdrahtet hat, sollte diesen Wechsel zum Anlass nehmen, das zu ändern.
Offen ist noch, wann Haiku 5.5 erscheint und ob Anthropic einen Abkündigungstermin für Sonnet 5 nennt. Bis dahin besteht kein Zeitdruck, Sonnet 5 läuft weiter.
Passende Anleitungen auf S-EDV
- LiteLLM als LLM-Gateway mit Docker: Modelle zentral routen, Budgets setzen und neue Modell-IDs schrittweise ausrollen.
- Claude Sonnet 5: Release, Preise und API: Hintergrund zum direkten Vorgänger und seinen Thinking-Änderungen.
- Claude Opus 5.5 vorgestellt: das größere Modell der 5.5-Familie im Überblick.
Quellen
- Anthropic: Ankündigung Claude Sonnet 5.5 (28.09.2026)
- Anthropic Dokumentation: Modellseite Claude Sonnet 5.5
- Anthropic Dokumentation: Neuerungen und Breaking Changes in Claude Sonnet 5.5
- Anthropic Dokumentation: Preisübersicht
- heise online: Claude Sonnet 5.5, schnelleres und günstigeres Mittelklassemodell (28.09.2026)
- THE DECODER: Anthropic stellt Claude Sonnet 5.5 vor (28.09.2026)


