Anthropic dreht den Preiskampf bei KI-Modellen deutlich weiter. Mit Claude Haiku 5.5 bringt das Unternehmen am 7. Oktober 2026 sein bislang günstigstes und schnellstes kleines Claude-Modell auf den Markt. Besonders interessant ist dabei nicht nur der Preis: In mehreren von Anthropic veröffentlichten Benchmarks liegt Haiku 5.5 sogar vor OpenAIs GPT-6 Luna.
Das Modell ist ausdrücklich nicht als Ersatz für Claude Sonnet 5.5 oder Opus 5.5 gedacht. Anthropic positioniert Haiku vielmehr dort, wo KI-Agenten künftig einen Großteil ihrer Arbeit erledigen dürften: bei sehr vielen kleinen, schnellen und wiederkehrenden Aufgaben.
0,10 Dollar pro Million Input-Tokens
Der auffälligste Wert ist der API-Preis. Bei Prompts mit bis zu 100.000 Tokens verlangt Anthropic für Claude Haiku 5.5:
- 0,10 Dollar pro Million Input-Tokens
- 0,50 Dollar pro Million Output-Tokens
- 0,01 Dollar pro Million Cache-Read-Tokens
- 0,125 Dollar pro Million Cache-Write-Tokens
Bei Prompts über 100.000 Tokens steigen die Preise auf 0,50 Dollar für Input und 2,50 Dollar für Output.
Zum Vergleich: Claude Haiku 4.5 kostet 1 Dollar pro Million Input-Tokens und 5 Dollar pro Million Output-Tokens. Bei typischen kurzen Aufgaben sinkt der reine Tokenpreis damit um 90 Prozent. Anthropic spricht über alle Workloads hinweg von durchschnittlich rund 75 Prozent niedrigeren Kosten.
Das ist für einzelne Chat-Anfragen kaum spektakulär. Für automatisierte Systeme mit Tausenden oder Millionen Modellaufrufen verändert es jedoch die Kalkulation erheblich.
Haiku 5.5 ist für Agenten gebaut
Anthropic nennt Zusammenfassungen, Datenbankabfragen, Klassifizierung und sogenannte Compaction-Aufgaben ausdrücklich als Einsatzbereiche. Hinzu kommen Browser-Steuerung, Kundensupport und der Einsatz als Subagent innerhalb größerer Agentensysteme.
Das ist vermutlich der wichtigere Teil der Ankündigung.
Ein leistungsfähiges KI-System muss nicht jede Aufgabe mit seinem teuersten Modell erledigen. Ein großes Modell kann planen und Entscheidungen treffen, während zahlreiche günstigere Subagenten Informationen suchen, Dokumente analysieren, Datenbanken abfragen oder Ergebnisse vorfiltern.
Genau dafür positioniert Anthropic Haiku 5.5.
Bei einem Coding-Agenten könnte beispielsweise Opus oder Sonnet die eigentliche Aufgabe planen, während Haiku parallel Dateien durchsucht, Dokumentation auswertet oder einzelne Teilprobleme bearbeitet.
Haiku 5.5 schlägt GPT-6 Luna in mehreren Anthropic-Tests
Bemerkenswert sind dabei die von Anthropic veröffentlichten Benchmark-Ergebnisse. Das kleine Haiku-Modell liegt in mehreren Tests vor OpenAIs GPT-6 Luna.
| Benchmark |
Claude Haiku 5.5 |
GPT-6 Luna |
Claude Sonnet 5.5 |
| GDPval-AA v2.1 |
1620 |
1437 |
1840 |
| AA-Briefcase v1.1 |
1578 |
1336 |
1824 |
| OSWorld 2.1 |
72,4 % |
48,9 % |
83,9 % |
| Terminal-Bench 4.0 |
39,2 % |
16,4 % |
70,6 % |
| FrontierCode 1.1 |
46,4 % |
42,4 % |
52,1 % |
Die Zahlen stammen von Anthropic selbst und sollten entsprechend eingeordnet werden. Sie zeigen aber, wohin sich der Wettbewerb verschiebt: Nicht jedes leistungsfähige Modell muss ein teures Spitzenmodell sein.
Vor allem beim Computer-Use-Test OSWorld ist der Abstand auffällig. Dort erreicht Haiku 5.5 laut Anthropic 72,4 Prozent gegenüber 48,9 Prozent für GPT-6 Luna.
Erstmals lässt sich bei Haiku der Denkaufwand einstellen
Claude Haiku 5.5 ist außerdem das erste Haiku-Modell mit einem einstellbaren Effort-Level.
Entwickler können damit je nach Aufgabe stärker zwischen Geschwindigkeit, Kosten und Modellleistung gewichten. Eine einfache Klassifizierung benötigt beispielsweise keinen maximalen Denkaufwand, während ein schwieriger Teilauftrag innerhalb eines Agentensystems mehr Rechenleistung bekommen kann.
Gerade bei automatisierten Workflows ist das relevant. Statt für jede Anfrage dieselbe Modellleistung zu bezahlen, lässt sich die Rechenleistung stärker an die jeweilige Aufgabe anpassen.
Anthropic senkt gleichzeitig die Kosten von Sonnet 5.5
Die Haiku-Veröffentlichung ist gleichzeitig Teil einer größeren Preisoffensive.
Anthropic halbiert die Kosten für Cache-Reads bei Claude Sonnet 5.5. Nach Angaben des Unternehmens sinken dadurch die Kosten typischer Agenten-Workloads mit Sonnet um ungefähr 20 Prozent.
Damit entsteht eine zunehmend klare Modellhierarchie:
- Haiku 5.5 für sehr viele schnelle und günstige Aufgaben
- Sonnet 5.5 für anspruchsvollere Alltags- und Agentenarbeit
- Opus 5.5 für Aufgaben, bei denen maximale Modellleistung wichtiger als der Preis ist
Für Agentensysteme ist diese Kombination möglicherweise wichtiger als ein einzelnes Spitzenmodell.
Der KI-Preiskampf verändert sich
Der Wettbewerb zwischen OpenAI, Anthropic und anderen Anbietern wurde lange hauptsächlich über Benchmarks und die Leistungsfähigkeit ihrer jeweils größten Modelle geführt.
Claude Haiku 5.5 zeigt, dass sich der Wettbewerb zunehmend auf eine andere Kennzahl verlagert: Wie viel brauchbare KI-Leistung bekommt ein Entwickler für einen Dollar?
Bei einem Inputpreis von 0,10 Dollar pro Million Tokens werden Aufgaben wirtschaftlich, für die ein großes Sprachmodell bisher unnötig teuer gewesen wäre.
Das betrifft beispielsweise automatisierte Recherche, Dokumentenklassifizierung, SEO-Analyse, Datenaufbereitung, Monitoring oder Systeme mit Dutzenden parallelen Subagenten.
Bei solchen Anwendungen ist nicht entscheidend, welches Modell einen einzelnen Benchmark gewinnt. Entscheidend ist, wie viel zuverlässige Arbeit ein System für einen bestimmten Betrag erledigen kann.
Kleine Modelle werden für Agentensysteme wichtiger
Die Entwicklung zeigt damit auch eine interessante Verschiebung bei KI-Agenten.
Die Zukunft könnte weniger daraus bestehen, jede Aufgabe an ein einziges möglichst intelligentes Modell zu schicken. Stattdessen übernimmt ein starkes Modell Planung und Kontrolle, während viele kleine Modelle die eigentliche Routinearbeit erledigen.
Claude Haiku 5.5 ist genau für diese zweite Ebene gebaut.
Dass ein Modell dieser Preisklasse gleichzeitig bei mehreren von Anthropic veröffentlichten Agenten-Benchmarks vor GPT-6 Luna liegt, macht die Veröffentlichung deshalb interessanter als eine gewöhnliche Modellaktualisierung.
Anthropic verkauft mit Haiku 5.5 nicht einfach ein kleineres Claude.
Das Unternehmen versucht, den Preis für massenhaft eingesetzte KI-Agenten nach unten zu drücken.
Verfügbarkeit
Claude Haiku 5.5 ist ab sofort über die Claude Platform sowie über Amazon Web Services, Google Cloud und Microsoft Azure verfügbar. Die Modell-ID für die API lautet claude-haiku-5-5.
Quelle: Anthropic – Claude Haiku 5.5