Anthropic veröffentlicht Claude Haiku 5.5: Der Preis ist deutlich reduziert, aber der neue Tokenizer wird mehr Token verbrauchen

📅 2026-10-08

Zusammenfassung:

Anthropic veröffentlicht offiziell Claude Haiku 5.5, das dritte Modell der Claude 5.5-Serie und die neue Generation von Haiku-Modellen, die fast ein Jahr nach Claude Haiku 4.5 auf den Markt kam. Anthropic positioniert es als leichtgewichtiges Modell für Aufgaben mit hoher Parallelität, geringer Latenz und kostensensiblen Aufgaben, und durch die deutliche Reduzierung des API-Preises steigt Haiku 5.5 direkt in die Konkurrenz der aktuellen kostengünstigen KI-Modelle ein.

Artificial Analysis Intelligence Index (7 Okt '26).png

Laut den von Anthropic bekannt gegebenen Preisen beträgt der Eingabepreis von Claude Haiku 5.5 für Anfragen innerhalb von 100.000 Token 0,10 US-Dollar pro Million Token und der Ausgabepreis 0,50 US-Dollar pro Million Token. Im Vergleich zu den Preisen der Vorgängergeneration Haiku 4.5, die 1 US-Dollar bzw. 5 US-Dollar lagen, wurde der Buchpreis direkt um 90 % gesenkt.

Wenn die Anfrage 100.000 Token übersteigt, wird der Preis von Haiku 5.5 erheblich steigen, wobei die Input- und Output-Preise auf 0,50 US-Dollar bzw. 2,50 US-Dollar pro Million Token steigen. Mit anderen Worten: Sobald der Schwellenwert von 100.000 Token überschritten wird, betragen die Input- und Output-Preise das Fünffache des Grundpreises.

Anthropic gab an, dass die durchschnittlichen Betriebskosten von Haiku 5.5 auf der Grundlage tatsächlicher Arbeitsbelastungsberechnungen etwa 75 % niedriger sind als die von Haiku 4.5. Einer der wichtigen Gründe dafür, dass der durchschnittliche Preisnachlass nicht 90 % des beworbenen Preises erreicht hat, ist, dass Haiku 5.5 einen neuen Wortsegmentierer verwendet.

Der neue Tokenizer ähnelt der von Claude Sonnet 5.5 und Opus 5.5 verwendeten Tokenisierungsmethode. Derselbe Text kann in Haiku 5.5 als mehr Token berechnet werden. Anthropics eigene Anweisungen zeigen, dass die neue Wortsegmentierungsmethode die Anzahl der generierten Token bei der Erledigung derselben Aufgabe leicht erhöhen wird; Einige tatsächliche Tests haben ergeben, dass derselbe lange Text in Haiku 5.5 etwa 25 % bis 30 % mehr Token verbrauchen kann als in Haiku 4.5.

Das bedeutet, dass Haiku 5.5 „versteckte Kosten“ hat, die leicht übersehen werden. Obwohl der Preis pro Million Token deutlich gesunken ist, hängt die tatsächliche Gebühr, die Benutzer zahlen, auch davon ab, wie viele Token das Modell verbraucht, um die Aufgabe zu erledigen. Daher kann ein einfacher Vergleich des Preises pro Million Token die tatsächlichen Betriebskosten der beiden Modellgenerationen nicht vollständig widerspiegeln.

Haiku 5.5 verfügt immer noch über ein sehr großes Kontextfenster, das bis zu 1 Million Token unterstützt, und die maximale Ausgabelänge erreicht 128.000 Token. Es unterstützt außerdem adaptive Denkfähigkeiten, die je nach Komplexität der Aufgabe dynamisch entscheiden können, wie viel Argumentationsressourcen investiert werden müssen.

Anthropic betonte ausdrücklich, dass der Fokus von Haiku 5.5 nicht darauf liegt, bei allen komplexen Aufgaben mit Opus 5.5 oder Sonnet 5.5 zu konkurrieren, sondern eine große Anzahl hochfrequenter, sich wiederholender und reaktionsgeschwindigkeitsempfindlicher Arbeiten durchzuführen. Geeignete Anwendungsszenarien für Haiku 5.5 sind beispielsweise Textzusammenfassung, Datenklassifizierung, Informationsextraktion, Datenbankabfrage, Anforderungsrouting, Kontextkomprimierung usw.

Im Bereich AI Agent ist Haiku 5.5 auch als Hilfsmodell für große Modelle konzipiert. Anthropic empfiehlt Entwicklern, Sonnet 5.5 oder Opus 5.5 für komplexe Hauptaufgaben verantwortlich zu machen und Haiku 5.5 dann als Subagent für die Abwicklung einer großen Anzahl einfacher, sich wiederholender Vorgänge zu überlassen, wodurch die Betriebskosten des gesamten Agentensystems gesenkt werden.

1780331851_scale_1200.webp

Die Codeentwicklung ist auch eine der wichtigen Anwendungsrichtungen von Haiku 5.5. Anthropic sagte, dass das Modell als Codierungs-Subagent des großen Claude-Modells verwendet werden kann, um Codesuchen, einfache Änderungen und andere sich wiederholende Aufgaben zu bewältigen, die aufgeteilt werden können. Bei komplexen mehrstufigen Agentenprogrammierungsaufgaben bieten Sonnet 5.5 und Opus 5.5 jedoch noch offensichtlichere Vorteile.

Geschwindigkeit ist ein weiteres großes Verkaufsargument von Haiku 5.5. Laut Anthropic ist dies das bisher reaktionsschnellste Modell des Unternehmens und eignet sich daher besonders für Echtzeit-Kundenservice, Browservorgänge und Anwendungen, die schnelles Feedback erfordern.

Anthropic senkte nicht nur den Preis von Haiku 5.5 selbst, sondern passte gleichzeitig auch den Cache-Lesepreis von Claude Sonnet 5.5 an. Die Cache-Lesegebühr wird von 0,20 US-Dollar auf 0,10 US-Dollar pro Million Token reduziert, was einer Reduzierung um 50 % entspricht. Anthropic geht davon aus, dass diese Änderung die tatsächlichen Kosten von Sonnet 5.5 bei den meisten Agenten-Workloads um etwa 20 % senken kann, da Agenten-Aufgaben häufig wiederholt Cache-Inhalte lesen.

Das Interessanteste am Haiku 5.5 ist jedoch seine Konkurrenz zu günstigeren Modellen. Basierend auf dem Standardpreis von weniger als 100.000 Token liegt Haiku 5.5 bereits in der gleichen Preisklasse wie das neueste Low-Cost-Modell von OpenAI. Dies bedeutet, dass Entwickler jetzt ein Modell mit einem Kontextfenster von Millionen von Tokens, Unterstützung für adaptives Denken und starken Codierungsfunktionen zu einem sehr niedrigen Token-Preis erhalten können.

Andererseits könnte die Preistrennungslinie von 100.000 Token auch zu einem Problem werden, dem Entwickler besondere Aufmerksamkeit schenken müssen. Bei gewöhnlichen Kurztextanfragen hat dieser Schwellenwert normalerweise keine Auswirkung; Aber für Szenarien mit langer Dokumentenverarbeitung, komplexen Agenten, mehreren Runden von Codeaufgaben und einer großen Menge an Kontexteingaben gleichzeitig kann das Modell leicht 100.000 Token erreichen oder diese sogar überschreiten. Sobald diese Grenze überschritten wird, erhöhen sich sowohl die Input- als auch die Outputpreise direkt um das Fünffache.

Dadurch wird auch die Token-Effizienz selbst immer wichtiger. Da der Preis von KI-Modellen weiter sinkt, müssen Entwickler, die sich früher nur darauf konzentrieren mussten, „wie viel kostet es pro Million Token“, nun auch berücksichtigen, wie viele Token das Modell verbraucht, um dieselbe Aufgabe zu erfüllen. Ein Modell, das einen niedrigeren Stückpreis hat, aber mehr Token generieren muss, um die Aufgabe abzuschließen, hat möglicherweise nicht immer niedrigere tatsächliche Endkosten.

Anthropic bietet Haiku 5.5 derzeit auf der Claude-Plattform und Kanälen wie Amazon Web Services, Google Cloud und Microsoft Foundry an und hat es auch zu Claude Code hinzugefügt. Normale Benutzer können Haiku 5.5 auf Claudes Webseite sowie in iOS- und Android-Apps verwenden.

Mit Blick auf die gesamte Claude 5.5-Produktlinie hat Anthropic eine relativ klare Arbeitsteilung gebildet: Opus 5.5 ist für die komplexesten Argumentations- und Agentenaufgaben verantwortlich, Sonnet 5.5 ist für das Gleichgewicht zwischen Leistung und Kosten verantwortlich, und Haiku 5.5 konzentriert sich weiter auf Szenarien mit hoher Parallelität, geringer Latenz und niedrigen Kosten.

Daher liegt die wahre Wettbewerbsfähigkeit von Haiku 5.5 nicht nur in der „Billigkeit“, sondern im Versuch von Anthropic, einen niedrigeren Stückpreis zu nutzen, um ein Modell mit starker Argumentation und Agentenfähigkeiten in groß angelegte Anrufszenarien zu drängen. Die neue Token-Messmethode und der Preissprung nach 100.000 Token bedeuten jedoch auch, dass Unternehmen die Gesamtkosten auf der Grundlage der tatsächlichen Arbeitslast vor der Bereitstellung berechnen müssen, anstatt nur auf den beworbenen Preis pro Million Token zu achten.

Wenn KI-Agenten in Zukunft weiter populär werden, wird sich eine große Anzahl von Modellanrufen von einer Frage und Antwort heute auf Dutzende oder sogar Hunderte von kontinuierlichen Anrufen ändern. In diesem Fall wirken sich der Preis eines einzelnen Anrufs, die Reaktionsgeschwindigkeit und die Effizienz des Token-Verbrauchs direkt auf die Betriebskosten des gesamten KI-Systems aus. Vor diesem Hintergrund wurde Haiku 5.5 ins Leben gerufen. Sein eigentliches Ziel besteht wahrscheinlich nicht darin, das leistungsstärkste Claude-Modell zu werden, sondern darin, die „Low-Cost-Engine“ zu werden, die das größte Anrufvolumen im gesamten KI-Ökosystem von Anthropic trägt.

Verwandte Tags

Ähnliche Artikel

Kommentare

0/500
Captcha (click to refresh)
Keine Kommentare