Claude Haiku 5.5 ist da: günstige Routinearbeit, neuer API-Umstieg
Claude Haiku 5.5 ist seit 7. Oktober verfügbar. Das Modell bietet günstigere Routineverarbeitung, verlangt aber angepasste API-Parameter und neu berechnete Tokenbudgets.

Support-Tickets sortieren, Dokumente zusammenfassen und einzelne Datenfelder extrahieren: Für solche wiederkehrenden Aufgaben hat Anthropic am 7. Oktober 2026 Claude Haiku 5.5 veröffentlicht. Das kleine Modell soll hohe Anfragevolumen schneller und günstiger bearbeiten. Für Unternehmen mit Haiku-4.5-Integrationen ist der Start jedoch nicht nur eine neue Modell-ID, sondern ein API-Wechsel mit inkompatiblen Parametern und verändertem Tokenverbrauch.
Ein Notfallupdate ist nicht erforderlich. Ein geplanter Vergleich mit eigenen Aufgaben ist sinnvoll, bevor produktive Automatisierungen umgestellt werden. Reine Nutzer lokaler Modelle sind nicht betroffen; bei Drittanbieter-Anwendungen entscheidet deren Betreiber über den Wechsel. Der bisherige Sonnet-5.5-Bericht enthielt nur die Vorankündigung von Haiku. Jetzt liegen Release, Modellidentität und Migrationshinweise vor.
Was ist neu?
Anthropic nennt auf der Ankündigungsseite und in der offiziellen Modellübersicht übereinstimmend den 7. Oktober als Veröffentlichungsdatum. Die feste API-ID lautet claude-haiku-5-5, ohne Datumssuffix und ohne separaten Alias. Auf Amazon Bedrock lautet sie anthropic.claude-haiku-5-5. Das Modell ist laut Hersteller auf der Claude API, Amazon Bedrock, Google Cloud und Microsoft Foundry verfügbar. Eine Freischaltung in jeder einzelnen Region oder jedem Unternehmenskonto ist damit nicht nachgewiesen.
- Das Kontextfenster umfasst eine Million Tokens, die synchrone maximale Ausgabe 128.000 Tokens.
- Adaptive Thinking ist standardmäßig aktiv; die API-Voreinstellung für den Aufwand ist
medium. - Haiku unterstützt erstmals eine einstellbare Effort-Stufe, um Aufwand und Ergebnisqualität auszubalancieren.
- Für eng begrenzte Aufgaben und Subagenten empfiehlt Anthropic Haiku; komplexes agentisches Coding bleibt eher Sonnet oder Opus vorbehalten.
Warum die Ersparnis vom Arbeitsprofil abhängt
Für Prompts bis einschließlich 100.000 Tokens liegen die veröffentlichten Tokenpreise 90 Prozent unter Haiku 4.5. Oberhalb dieser Grenze beträgt die Senkung gegenüber dem Vorgänger 50 Prozent; innerhalb des neuen Modells springt die Tarifstufe auf das Fünffache. Auch die Ausgabetokens werden anhand dieser Promptgrenze unterschiedlich berechnet. Lange Dokumentenpakete gehören deshalb in eine eigene Budgetklasse.
Anthropic beziffert die durchschnittliche Ersparnis pro Arbeit auf rund 75 Prozent. Das ist eine Herstellerkalkulation, keine Zusage für jede Anwendung. Die Dokumentation erklärt den wichtigsten Gegenfaktor: Derselbe Eingabetext erzeugt mit dem neuen Tokenizer ungefähr 30 Prozent mehr Tokens als bei Haiku 4.5. Der genaue Unterschied hängt vom Inhalt ab. Alte Tokenzählungen, Ausgabegrenzen und Kostenprognosen lassen sich deshalb nicht unverändert übernehmen.
Welche Integrationen Anpassungen brauchen
Der offizielle Migrationsleitfaden nennt konkrete Fehlerbilder. Manuelles Thinking mit budget_tokens wird durch adaptive Verarbeitung ersetzt. Eine abschließende Assistant-Nachricht als vorgegebener Antwortanfang wird abgewiesen. Nicht unterstützte Sampling-Einstellungen können HTTP 400 auslösen. Der Umstieg allein durch Austausch des Modellnamens reicht für solche Messages-API-Anwendungen nicht aus.
temperature,top_pundtop_ksollten aus Anfragen entfernt werden; die Dokumentation beschreibt nur eng begrenzte Ausnahmen für Standardwerte.- Antwortblöcke müssen nach ihrem
typeausgewählt werden, nicht über ihre Position. Vor dem eigentlichen Text können Thinking-Blöcke stehen. - Kleine
max_tokens-Grenzen können bereits nach dem Thinking erreicht werden, bevor überhaupt Antworttext entsteht. - Computer Use auf Claude API und Google Cloud benötigt
computer_toolset_20260801statt des bisherigen Werkzeugs.
Wie dringend ist der Wechsel?
Die Meldung betrifft Betrieb und Wirtschaftlichkeit, nicht eine neue Sicherheitslücke. Bestehende Automatisierungen sollten nicht ungeprüft umgestellt werden. Haikus Cybersecurity-Filter erlauben laut Anthropic defensive Aufgaben, blockieren aber weiterhin Penetrationstests. Der Leitfaden verlangt die Behandlung von stop_reason: "refusal"; ein serverseitiger Ersatz für abgelehnte Anfragen existiert nicht. Das ist für Sicherheitsteams und unbeaufsichtigte Abläufe relevant.
Die Benchmarks zeigen nach Herstellerangaben deutliche Fortschritte: Terminal-Bench 4.0 erreicht 39,2 Prozent statt null Prozent beim Vorgänger, OSWorld 2.1 im Offline-Teil 72,4 statt 15,7 Prozent. Diese Werte sind keine unabhängig überprüften Ergebnisse dieser Redaktion und belegen keine Zuverlässigkeit für eigene Geschäftsprozesse.
Was sollten Admins jetzt prüfen?
- Zuerst Haiku-4.5-Modell-IDs in Anwendungen, Gateways und Konfigurationen inventarisieren, einschließlich Plattform und zuständigem Team.
- Danach Thinking-Parameter, Sampling-Einstellungen und Assistant-Vorgaben gegen den Migrationsleitfaden abgleichen.
- Repräsentative Aufgaben mit neu gezählten Tokens vergleichen: Ergebnisqualität, Laufzeit, Abbrüche und Verbrauch gemeinsam erfassen.
- Prompts nahe 100.000 Tokens gesondert prüfen und Budgets anhand der tatsächlichen Tarifstufe kalkulieren.
- Ablehnungen und leere Antworten im Monitoring sichtbar machen; eine Rückkehr zum bisherigen Modell vorbereiten.
Für KMU liegt der Nutzen in günstigerer Routineverarbeitung, nicht darin, jeden Agenten pauschal zu ersetzen. Der kontrollierte Umstieg mit klaren Qualitätskriterien ist wichtiger als eine einzelne Benchmarkzahl.
Passende Anleitungen auf S-EDV
- LibreChat mit Docker betreiben: Hintergrund zur Einbindung von Claude in eine zentral verwaltete Chat-Oberfläche.
- Sonnet 5.5 und seine API-Änderungen: Vergleich zur größeren Modellklasse, deren Migrationsregeln nicht ungeprüft auf Haiku übertragbar sind.


