Claude Haiku 5.5 ist Anthropics neues Modell für schnelle, wiederholte und häufig ausgeführte Aufgaben. Die Vorstellung erfolgte am 7. Oktober 2026. Niedrigere Preise und ein einstellbarer Denkaufwand werfen eine praktische Frage auf: Welche Arbeit kann ein günstigeres Modell übernehmen, ohne das Ergebnis zu verschlechtern?
Es ersetzt Sonnet oder Opus nicht automatisch. Eine begrenzte Aufgabe wie das Zusammenfassen eines Dokuments verlangt etwas anderes als eine komplexe Softwareänderung. Der Preis muss zusammen mit Fehlern, Wiederholungen und dem Aufwand für die Kontrolle betrachtet werden.
Claude Haiku 5.5: Preise unter und über 100.000 Tokens
Die offizielle Preistabelle unterscheidet zwei Bereiche nach Prompt-Länge. Die Grenze beeinflusst eine Kostenschätzung deutlich. Der günstigere Tarif darf nicht pauschal für alle langen Anfragen angesetzt werden.
| Preis je Million Tokens | Prompts bis 100.000 Tokens | Prompts über 100.000 Tokens |
|---|---|---|
| Eingabe | 0,10 US-Dollar | 0,50 US-Dollar |
| Ausgabe | 0,50 US-Dollar | 2,50 US-Dollar |
| Cache-Lesen | 0,01 US-Dollar | 0,05 US-Dollar |
| Cache-Schreiben, fünf Minuten | 0,125 US-Dollar | 0,625 US-Dollar |
Das sind API-Listenpreise und keine Preise für ein Chat-Abonnement. Cache-Dauer, regionale Verarbeitung, Cloud-Anbieter und weitere Bedingungen können die Rechnung verändern. Für einen Vergleich musst du den tatsächlichen Zugangsweg betrachten.
Ein rein rechnerisches Beispiel: Eine Million nicht zwischengespeicherte Eingabe-Tokens und 200.000 Ausgabe-Tokens kosten bei Anfragen im unteren Bereich insgesamt 0,20 US-Dollar für diese beiden Positionen. Im oberen Bereich kosten dieselben Mengen 1 US-Dollar. Zusätzliche Dienste, Steuern und andere Anpassungen sind dabei nicht berücksichtigt.
Ein niedrigerer Tokenpreis garantiert keine identische Ersparnis
Die Startankündigung unterscheidet gesenkte Stückpreise von einer geschätzten durchschnittlichen Ersparnis gegenüber Haiku 4.5. Eine Verringerung bestimmter Tarife um 90 Prozent bedeutet nicht, dass jede Aufgabe exakt 90 Prozent günstiger abgeschlossen wird.
Das Modell kann mehr Tokens verwenden, mit anderem Aufwand arbeiten oder weitere Versuche benötigen. Eine alte Rechnung einfach mit einem beworbenen Rabatt zu multiplizieren reicht deshalb nicht. Messe deine Aufgaben einschließlich des Anteils oberhalb der Prompt-Grenze.
Ein sinnvoller Versuch erfasst reale Beispiele, erwartete Ergebnisse, Verbrauch und notwendige Nacharbeit. Wird häufig ein zweiter Aufruf an ein stärkeres Modell nötig, kann trotzdem eine Ersparnis entstehen. Sie muss aber über die gesamte Kette berechnet werden, nicht nur für den ersten Aufruf.
Einstellbarer Aufwand braucht eigene Tests
Die Dokumentation zu Effort erläutert die Steuerung kompatibler Modelle. Für einen Dienst ist nicht grundsätzlich die höchste Einstellung sinnvoll, sondern der ausreichende Aufwand für den jeweiligen Auftrag.
Eine einfache Klassifikation braucht möglicherweise weniger Überlegung als ein mehrdeutiger Fall. Werte leichte und schwierige Beispiele getrennt aus. Eine gute Durchschnittsleistung kann ausgerechnet dort Fehler verstecken, wo ihre Folgen besonders teuer sind.
Prüfe vor einer Umstellung in Produktion außerdem den Migrationsleitfaden. Ähnliche Namen bedeuten nicht identisches Verhalten. Parameter, Ausgabe und mögliche Rückschritte sollten in der tatsächlichen Einsatzumgebung kontrolliert werden.
Ein Unteragent sollte eine klare Verantwortung erhalten
Ein interessantes Muster teilt Aufgaben auf. Das führende Modell koordiniert eine Änderung, während ein Unteragent einen begrenzten Auftrag erhält: eine Konvention finden, eine ausgewählte Datei zusammenfassen oder eine überprüfbare Einordnung vorbereiten. Diese Grenze macht Ergebnis und Kosten leichter nachvollziehbar.
Unser Leitfaden zu Claude Code erklärt, warum Memory, Kontext und Kanalgrenzen wichtig sind. Ein günstigeres Modell repariert keine unklare Aufgabe. Es kann stattdessen zusätzliches Material erzeugen, das anschließend geprüft werden muss.
Delegiere nicht stillschweigend Berechtigungen, Löschungen oder Änderungen an Zugriffsregeln. Das Modell kann eine semantische Teilaufgabe bearbeiten; für sensible Aktionen bleibt der kontrollierende Prozess verantwortlich. Eine richtige Zusammenfassung ist keine Freigabe zum Handeln.
Haiku und Sonnet: den abgeschlossenen Auftrag vergleichen
Die richtige Frage lautet nicht, welches Modell immer gewinnt. Entscheidend ist, welches diese konkrete Arbeit zu akzeptablen Gesamtkosten erledigt. Eine lange Änderung mit vielen Abhängigkeiten kann ein leistungsfähigeres Modell rechtfertigen. Kurze, begrenzte und beobachtbare Aufgaben passen eher zu Haiku.
Anthropic hat außerdem Sonnet 5.5 beim Lesen aus dem Cache günstiger gemacht. Ein Vergleich nur anhand des Eingabepreises ist dadurch noch weniger aussagekräftig. Ein Agent mit häufig wiederverwendetem Kontext hat eine andere Kostenstruktur als eine einzelne Klassifikation.
Die Methode aus unserem Vergleich von KI-Modellen bleibt relevant: repräsentative Beispiele auswählen und Fehler, Latenz sowie tatsächlichen Abschluss messen. Ein veröffentlichter Benchmark lässt sich nicht ungeprüft auf dein Produkt übertragen.
Fragen vor der Einführung
- Wie viele Anfragen überschreiten tatsächlich 100.000 Tokens?
- Welche Ergebnisse lassen sich automatisch prüfen?
- Wie teuer ist die Korrektur einer falschen Antwort?
- Wann muss Sonnet, Opus oder ein Mensch übernehmen?
- Passen die Bedingungen des Anbieters zu den verglichenen Preisen?
Auf der Claude Platform lautet die Modellkennung claude-haiku-5-5. Kontrolliere bei anderen Zugangswegen den jeweiligen Katalog und die Bedingungen. Verfügbarkeit bedeutet nicht unbegrenzte Nutzung in jedem Abonnement oder jeder Oberfläche.
Beginne mit einer Einführung, deren Umfang du beobachten kannst. Vergleiche eine feste Stichprobe mit dem bisherigen Modell und untersuche besonders schwierige Fehler. Eine schrittweise Migration zeigt eher, ob günstigere Aufrufe auch günstigere abgeschlossene Aufgaben ergeben.
Für wiederkehrende Arbeit ist ein klarer Eskalationsweg besonders wichtig. Definiere vorab, welche unvollständigen oder mehrdeutigen Ergebnisse weitergegeben werden. So hängt die Qualität nicht davon ab, ob jemand zufällig einen problematischen Einzelfall bemerkt. Die Ersparnis sollte nach dieser Nachprüfung weiterhin bestehen.
Claude Haiku 5.5 erweitert die Aufgaben, für die ein kleines Modell wirtschaftlich sinnvoll sein kann. Glaubwürdig wird der Vorteil mit einem klaren Auftrag, sichtbaren Fehlern und einem von Anfang an vorgesehenen Übergang zu einem stärkeren System.
