← Alle NewsKI-Modelle & Agenten

Claude Haiku 5.5: Was die 90 Prozent Preissenkung wirklich bringen

KI-generiert, redaktionell von 8thsense ausgewählt, geprüft und freigegeben. EU AI Act, Art. 50

Claude Haiku 5.5: Was die 90 Prozent Preissenkung wirklich bringen

Anthropic hat am 7. Oktober Claude Haiku 5.5 veröffentlicht, das neue kleinste Modell der Claude-Familie. Die Schlagzeile sind die Preise: Für Anfragen bis 100.000 Token kostet die API 0,10 Dollar pro Million Eingabe-Token und 0,50 Dollar pro Million Ausgabe-Token, ein Zehntel des Vorgängers Haiku 4.5. Oberhalb von 100.000 Token beträgt der Rabatt nur noch 50 Prozent, Anthropic selbst nennt im Schnitt rund 75 Prozent Ersparnis. Für Geschäftsführer ist das relevant, weil gerade die unspektakulären Automatisierungen wie E-Mail-Sortierung, Dokumentenauswertung oder Ticket-Vorqualifizierung mit solchen Modellen laufen, und deren laufende Kosten jetzt spürbar sinken.

Was Haiku 5.5 kann und was nicht

Anthropic positioniert das Modell für Aufgaben mit hohem Volumen: Zusammenfassungen, Klassifikation, Datenbankabfragen, Kundensupport in Echtzeit und als Hilfsmodell für die größeren Modelle Sonnet und Opus (Quelle: anthropic.com). Das Kontextfenster wächst von 200.000 auf 1 Million Token, die maximale Antwortlänge von 64.000 auf 128.000 Token (Quelle: heise.de). Neu ist zudem, dass Haiku erstmals selbst entscheidet, wie viel es vor der Antwort „nachdenkt“. Entwickler steuern das über fünf Stufen von Low bis Max, Standard in der API ist Medium (Quelle: platform.claude.com). Bemerkenswert offen ist Anthropic bei den Grenzen: Das Modell eigne sich am besten für eng umrissene Aufgaben, nicht für komplexe, mehrstufige Programmierarbeit.

Benchmarks: deutlicher Sprung, aber kein Allrounder

Im Intelligence Index des unabhängigen Testlabors Artificial Analysis erreicht Haiku 5.5 bei maximaler Denkstufe 43 Punkte, 26 mehr als der Vorgänger. Damit liegt es knapp vor Gemini 3.8 Flash (41) und GPT-6 Luna (38), aber klar hinter Sonnet 5.5 (56) (Quelle: artificialanalysis.ai). Die Zahlen sind nicht durchweg einheitlich: Beim Programmiertest Terminal-Bench 4.0 meldet Anthropic 39,2 Prozent gelöste Aufgaben, Artificial Analysis und heise kommen auf 33 Prozent. Für den Praxiseinsatz wichtiger sind zwei andere Befunde:

  • Faktenwissen: Haiku 5.5 beantwortet Wissensfragen seltener korrekt als die Konkurrenz (36 Prozent gegenüber 55 Prozent bei Gemini 3.8 Flash), erfindet aber auch seltener Antworten (Halluzinationsrate 40 gegenüber 55 Prozent).
  • Automatisierung: Im AutomationBench von Artificial Analysis kommt Haiku 5.5 nur auf 35 Prozent, die Wettbewerber auf 53 bis 60 Prozent. Die Tester vermuten, dass übervorsichtige Sicherheitsfilter das Ergebnis drücken, und kündigen einen neuen Durchlauf an.
  • Bedienung von Oberflächen: Im Test OSWorld 2.1 steigt der Anteil erfüllter Teilziele laut Anthropic von 15,7 auf 72,4 Prozent.

Der Haken: Tokenizer und Denkaufwand

Wer nur auf den Listenpreis schaut, rechnet sich die Ersparnis zu schön. Erstens hat Anthropic den Tokenizer gewechselt, also die Art, wie Text in abrechenbare Einheiten zerlegt wird. Anthropic spricht von „etwas mehr“ Token pro Aufgabe, heise beziffert den Mehrverbrauch bei identischem Text auf rund 30 Prozent. Die Entwicklerdokumentation stützt die Größenordnung: Eine Million Token entsprechen mit dem neuen Tokenizer etwa 555.000 Wörtern, mit dem alten waren es rund 750.000. Zweitens werden Denkschritte als Ausgabe-Token abgerechnet. Auf maximaler Stufe verbraucht Haiku 5.5 laut Artificial Analysis rund 162.000 Ausgabe-Token pro Testaufgabe, etwa dreimal so viel wie GPT-6 Luna. Der Wechsel von der zweithöchsten auf die höchste Stufe kostet rund 80 Prozent mehr Token für nur zwei zusätzliche Indexpunkte. Auf der Stufe High erreicht das Modell 38 Punkte mit etwa 55.000 Token.

Beispielrechnung: 1.000 E-Mails sortieren

Eine eigene, vereinfachte Rechnung zeigt, warum die Kosten pro Aufgabe zählen. Angenommen, ein Betrieb lässt täglich 1.000 eingehende E-Mails nach Anliegen sortieren, mit je 2.000 Token Eingabe (Anweisung plus Mail) und 300 Token Ausgabe nach altem Tokenizer. Mit Haiku 4.5 kostet das 2 Dollar Eingabe plus 1,50 Dollar Ausgabe, also 3,50 Dollar am Tag. Mit Haiku 5.5 und 30 Prozent Tokenizer-Aufschlag sind es 0,26 plus rund 0,20 Dollar, zusammen etwa 0,46 Dollar. Das sind gut 85 Prozent weniger, aber nur, solange die Denkstufe auf Low oder Medium bleibt. Weitere Hebel nennt die Dokumentation: Stapelverarbeitung über die Batch-API kostet die Hälfte, wiederverwendete Prompt-Bausteine aus dem Cache kosten nur 0,01 Dollar pro Million Token. Haiku 5.5 ist über Anthropic sowie über AWS, Google Cloud und Microsoft Azure verfügbar. In welcher Region die Daten verarbeitet werden, sollte vor dem Einsatz mit personenbezogenen Daten beim jeweiligen Anbieter geprüft werden.

Was das für Unternehmen bedeutet

Für viele Mittelständler kippt mit solchen Preisen die Wirtschaftlichkeitsrechnung: Die Modellkosten einer typischen Workflow-Automation liegen oft nur im einstelligen Dollarbereich pro Monat. Der teure Teil ist nicht mehr das Modell, sondern die saubere Einbindung in vorhandene Systeme. Eine Pflegevermittlung, die Anfragen aus Formular, Mail und Telefonnotiz vorsortiert, ein Handwerksbetrieb, der Lieferscheine ausliest, oder eine Tanzschule, die Kursanfragen beantwortet: Überall entscheidet die Anbindung an CRM, Buchhaltung oder Kalender darüber, ob die Automatisierung im Alltag trägt oder als Insellösung im Pilotstatus versandet. Gerade weil Haiku 5.5 laut Hersteller für eng umrissene Aufgaben gedacht ist, lohnt es sich, Prozesse vorher klar zu schneiden, statt ein günstiges Modell auf einen unklaren Ablauf loszulassen.

Praktisch heißt das: mit einem einzigen, gut messbaren Prozess starten, die Denkstufe bewusst niedrig ansetzen und nach zwei Wochen die tatsächlichen Kosten pro Vorgang auswerten, nicht den Listenpreis. Wer bereits Automatisierungen mit Haiku 4.5 betreibt, sollte den Wechsel testen, aber mit echten Daten nachrechnen. Wie sich solche Abläufe Schritt für Schritt in eine Prozessautomatisierung mit KI überführen lassen, hängt weniger vom Modell ab als von Datenlage und Schnittstellen. Teams mit Claude-Max- oder Team-Abo erhalten zudem monatliche API-Guthaben (bis zu 500 Dollar für Team-Pläne), die sich für solche Tests eignen, laut heise allerdings nicht für die interaktive Nutzung von Claude Code.

Quellen

Weiterführend: KI-Automation für den Mittelstand — wie 8thsense Geschäftsprozesse analysiert und automatisiert.

KI-Potenziale im eigenen Unternehmen erkennen?

AI-Audit anfragen →
Newsletter

KI-Briefing für den Mittelstand

Alle 2 Wochen: konkrete KI- & Automatisierungs-Impulse für Unternehmen. Kein Spam, jederzeit abbestellbar.

Neueste News

Alle News →
Claude Haiku 5.5: Was die 90 Prozent Preissenkung wirklich bringen — 8thsense