Claude Haiku 5.5: neue Preise, 90 Prozent günstiger
Anthropic senkt den Einstiegspreis auf 0,10 US-Dollar je Million Input-Token – aber nur bis 100.000 Token, danach wird es fünffach teurer.
Kurz gesagt
Claude Haiku 5.5 kostet seit dem 7. Oktober 2026 für Anfragen unter 100.000 Token 0,10 US-Dollar je Million Input- und 0,50 US-Dollar je Million Output-Token – rund 90 Prozent weniger als Haiku 4.5, oberhalb dieser Grenze aber das Fünffache.
Auf einen Blick
- Preis bis 100.000 Token: 0,10 / 0,50 US-Dollar je Million Input-/Output-Token; darüber 0,50 / 2,50 US-Dollar.
- Erstes Haiku-Modell mit einstellbarem Aufwand: Low, Med, High, Xhigh, Max. Modell-ID: claude-haiku-5-5.
- Benchmarks laut Anthropic: OSWorld 2.1 72,4 Prozent, Terminal-Bench 4.0 39,2 Prozent, FrontierCode 1.1 46,4 Prozent.
- Verfügbar über AWS, Google Cloud, Microsoft Azure und die Claude-Plattform; ab 7. Oktober 2026 auch in GitHub Copilot.
- Simon Willison misst rund 25 Prozent mehr Token pro Prompt als bei Haiku 4.5 – ein verdeckter Kostenzuschlag.
Claude Haiku 5.5 kostet seit dem 7. Oktober 2026 für Anfragen unter 100.000 Token 0,10 US-Dollar je Million Input- und 0,50 US-Dollar je Million Output-Token – rund 90 Prozent weniger als Haiku 4.5, oberhalb dieser Grenze aber das Fünffache.
Zwei Preisstufen in einem Modell
Anthropic teilt die Abrechnung an der Marke von 100.000 Token. Darunter gelten 0,10 US-Dollar für Input und 0,50 US-Dollar für Output je Million Token, Cache-Lesezugriffe liegen bei 0,01 US-Dollar, Cache-Schreibzugriffe bei 0,125 US-Dollar.
Oberhalb der Grenze verfünffachen sich alle vier Posten: 0,50 US-Dollar Input, 2,50 US-Dollar Output, 0,05 US-Dollar Cache-Lesen, 0,625 US-Dollar Cache-Schreiben. Der Vorgänger Haiku 4.5 kostete nach Angaben von Simon Willison durchgehend 1 US-Dollar und 5 US-Dollar je Million Token.
Anthropic beziffert die Ersparnis gegenüber Haiku 4.5 mit rund 75 Prozent im Betrieb und mit 90 Prozent für Anfragen unter 100.000 Token. Wer lange Kontexte fährt, sieht diesen Rabatt nie.
Der versteckte Aufschlag im Tokenizer
Willison weist auf einen Posten hin, der in keiner Preistabelle steht: Haiku 5.5 nutzt einen weniger großzügigen Tokenizer und braucht für identische Prompts etwa 25 Prozent mehr Token als Haiku 4.5. Die Listenpreise fallen damit stärker als die Rechnung.
In seinem SVG-Zeichentest kostete ein Durchlauf mit niedrigem Aufwand 0,000936 US-Dollar und dauerte 7 Sekunden. Mit maximalem Aufwand stieg derselbe Auftrag auf 0,033826 US-Dollar und 5 Minuten 9 Sekunden; Haiku 4.5 hatte ein Jahr zuvor 0,007583 US-Dollar gekostet.
Willison vergleicht die Staffelung außerdem mit GPT-6 Luna: Luna liegt in der Standardstufe gleich auf und steigt erst bei 272.000 Token auf 0,20 und 0,75 US-Dollar. Oberhalb von 100.000 Token ist Haiku 5.5 nach seiner Rechnung nicht mehr die günstigere Wahl.
Einstellbarer Aufwand, erstmals in der Haiku-Klasse
Haiku 5.5 ist laut Anthropic das erste Modell dieser Klasse mit regelbarem Aufwand über fünf Stufen: Low, Med, High, Xhigh und Max. Der Aufrufer entscheidet damit selbst, ob Tempo oder Denktiefe wichtiger ist – und Willisons Messung zeigt, wie weit Kosten und Laufzeit zwischen den Extremen auseinandergehen.
Die Modell-ID lautet claude-haiku-5-5. Verfügbar ist das Modell über die Claude-Plattform sowie über Amazon Web Services, Google Cloud und Microsoft Azure.
Was die Benchmarks hergeben
Anthropic nennt 72,4 Prozent auf OSWorld 2.1 (Offline-Teilmenge), 39,2 Prozent auf Terminal-Bench 4.0 und 46,4 Prozent auf FrontierCode 1.1. Auf Humanity's Last Exam stehen 45,9 Prozent ohne und 57,4 Prozent mit Werkzeugen.
Dazu kommen Elo-Werte von 1620 auf GDPval-AA v2.1 und 1578 auf AA-Briefcase v1.1 sowie 46,4 Prozent auf Chartography ohne Werkzeuge. Alle Zahlen stammen vom Hersteller; unabhängige Nachmessungen lagen zum Erscheinen nicht vor.
Anthropic nennt Haiku 5.5 das eigene bisher schnellste Modell und zitiert einen Kunden mit über 30 Prozent weniger Latenz und bis zu 2,5-fach schnellerer Inferenz pro Agentenschritt. Das ist eine Kundenangabe, keine von uns geprüfte Messung.
Am ersten Tag in GitHub Copilot
GitHub hat das Modell am 7. Oktober 2026 für Copilot Pro, Pro+, Max, Business und Enterprise freigeschaltet – wählbar von Visual Studio Code und den JetBrains-IDEs über Xcode und Eclipse bis github.com, Copilot CLI und GitHub Mobile. Die Ausspielung läuft laut GitHub schrittweise.
Abgerechnet wird zu den Listenpreisen des Anbieters über nutzungsbasierte Abrechnung. In Business- und Enterprise-Konten steuern Administratoren den Zugang über die Modellrichtlinie; neue Modelle sind dort standardmäßig aktiv, solange niemand sie abschaltet.
In eigenen frühen Tests habe Haiku 5.5 bei vielen Coding-Aufgaben mit Claude Sonnet 5 mitgehalten und dabei deutlich weniger Token und Arbeitsschritte verbraucht, schreibt GitHub. Eine Zahl dazu nennt das Changelog nicht.
Was offen bleibt
Keine der drei von uns gelesenen Seiten nennt eine Größe des Kontextfensters für Haiku 5.5, und keine sagt etwas über die Trainingsdaten. Beides ist damit unbelegt, nicht unverändert.
Offen ist auch, wie sich die Grenze von 100.000 Token in echten Agentenläufen auswirkt, die über viele Schritte Kontext anhäufen. Genau dort kippt nach Willisons Rechnung der Preisvorteil.
Häufige Fragen
Was kostet Claude Haiku 5.5?
Bis 100.000 Token 0,10 US-Dollar je Million Input- und 0,50 US-Dollar je Million Output-Token. Oberhalb dieser Grenze 0,50 und 2,50 US-Dollar.
Ist Claude Haiku 5.5 günstiger als Haiku 4.5?
Nach Listenpreis ja – Anthropic nennt rund 90 Prozent weniger unter 100.000 Token. Der neue Tokenizer braucht laut Simon Willison aber etwa 25 Prozent mehr Token, das frisst einen Teil der Ersparnis.
Wo kann ich Claude Haiku 5.5 nutzen?
Über die Claude-Plattform, AWS, Google Cloud und Microsoft Azure unter der Modell-ID claude-haiku-5-5 – sowie seit 7. Oktober 2026 in GitHub Copilot ab dem Pro-Tarif.