StartseiteArtikel

"Die Preise werden drastisch reduziert", Claude Haiku 5.5 treibt den Wettbewerb im Bereich kleiner KI-Modelle ins Zeitalter des Ein-Cent-Preises.

36氪的朋友们2026-10-08 08:25
Preiswettlauf bei kleinen Modellen.

Es ist fast ein Jahr seit der Veröffentlichung der vorherigen Haiku-Generation vergangen, und Anthropic hat endlich diese kleinste Produktlinie aktualisiert.

Am 7. Oktober nach US-Ortszeit wurde Claude Haiku 5.5 offiziell eingeführt. Das auffälligste Merkmal ist der Preis: Nur 0,1 US-Dollar pro Million Token für Eingaben und 0,5 US-Dollar für Ausgaben, was direkt ein Zehntel des Preises der vorherigen Haiku 4.5-Generation beträgt und mit dem von GPT-6 Luna übereinstimmt, das OpenAI im vergangenen Monat veröffentlicht hat.

Aber Anthropic geht dieses Mal offensichtlich nicht nur auf einen Preiskampf ein.

Als ein Modell mit geringerer Auslegung und höherer Geschwindigkeit hat Haiku 5.5 dieses Mal vor allem die Mängel von Haiku 4.5 in den Bereichen Programmierung, Computerbedienung und Wissensarbeit behoben.

Gleichzeitig wurde ein einstellbarer Modus hinzugefügt, der ein Kontextfenster von 1 Million Token unterstützt. Außerdem wurden die Cache-Preise für Sonnet gesenkt und API-Guthaben für Abonnenten eingeführt. Diese Veröffentlichung gleicht eher einer umfassenden Preisanpassung von Anthropic.

Der Krieg um kleine Modelle ist von der Phase, in der es darum ging, wer billiger ist, zu der Phase übergegangen, in der es darum geht, wer sowohl billig als auch leistungsstark ist.

01

Kleine Modelle sind nicht mehr „nur brauchbar“

Haiku 4.5 wurde vor fast einem Jahr veröffentlicht. Damals war es bereits das von Anthropic auf Geschwindigkeit und Kosten optimierte kleine Modell, aber im heutigen Wettbewerb der neuen Modellgeneration werden seine Mängel immer deutlicher. Es erreichte nur 735 Punkte im GDPval-AA-Wissenstest, 15,7 % bei OSWorld-Computerbedienung und sogar 0 Punkte bei Terminal-Bench-Programmierung.

Haiku 5.5 hat fast alle diese Mängel behoben.

Bei Tests wie Wissensarbeit, Computerbedienung und Programmierung hat Haiku 5.5 im Vergleich zur vorherigen Generation deutliche Verbesserungen erzielt. Dabei erreichte es 1620 Punkte bei GDPval-AA v2.1, was mehr als das Doppelte von Haiku 4.5 ist und auch die 1437 Punkte von GPT-6 Luna übersteigt.

Im AA-Briefcase-Wissenstest erreichte Haiku 5.5 1578 Punkte, was ebenfalls über den 1336 Punkten von Luna liegt. Bei der Offline-Teilmenge von OSWorld 2.1 erzielte es 72,4 %, während Luna 48,9 % und Haiku 4.5 nur 15,7 % erreichte.

Die Verbesserung der Programmierfähigkeiten ist besonders auffällig. Bei Terminal-Bench 4.0 erreichte Haiku 4.5 zuvor 0 %, während Haiku 5.5 inzwischen auf 39,2 % gestiegen ist.

Die Bewertungsagentur Artificial Analysis vergab einen Intelligenzindex von 43 Punkten, was 26 Punkte mehr als bei Haiku 4.5 ist, etwas höher als die 42 Punkte von GLM-5.3 Flash und die 41 Punkte von Gemini 3.8 Flash, vergleichbar mit den 44 Punkten von Kimi K3 und niedriger als die 56 Punkte des hauseigenen Sonnet 5.5.

Bei intelligenter Wissensarbeit erreichte Haiku 5.5 (Max-Modus) 1578 Elo bei AA-Briefcase, was vor Modellen wie Kimi K3 und GLM-5.3 liegt und mit Muse Spark 1.3 (Max-Modus) vergleichbar ist.

Aber kleine Modelle bleiben kleine Modelle, es gibt noch Lücken bei den Faktenkenntnissen. Die Genauigkeit bei AA-Omniscience beträgt nur 36 %, während sie bei Gemini 3.8 Flash 55 % und bei GPT-6 Luna 44 % beträgt.

Es gibt noch einen Test, bei dem Haiku 5.5 nicht gut abschneidet: Bei AutomationBench-AA erreichte es nur 35 %, während Luna, Gemini 3.8 Flash und GLM-5.3 Flash alle zwischen 53 % und 60 % liegen. Artificial Analysis weist darauf hin, dass dies möglicherweise darauf zurückzuführen ist, dass die Sicherheitsrichtlinie das Modell zu stark ablehnen lässt. Anthropic arbeitet an einer Behebung, nach der die Punktzahl voraussichtlich steigen wird.

Außerdem ist Haiku 5.5 das erste Haiku-Modell, das die Einstellung einstellbarer Modi unterstützt. Standardmäßig wird der Medium-Modus verwendet, es stehen insgesamt fünf Stufen zur Verfügung: Low, Medium, High, xhigh und Max. Je höher der Modus ist, desto mehr Rechenressourcen werden vom Modell eingesetzt, was normalerweise zu einer besseren Leistung führt, aber der Token-Verbrauch steigt entsprechend an.

02

So günstig, dass man es bedenkenlos nutzen kann

Parameter und Benchmark-Ergebnisse sind eine Sache, die praktische Nutzung eine andere. Am Veröffentlichungstag von Haiku 5.5 haben viele Entwickler es sofort ausprobiert und verschiedene interessante Tests durchgeführt.

Der unabhängige Entwickler Simon Willison hat es verwendet, um eine SVG-Grafik eines Pelikans zu generieren, der Fahrrad fährt. Im Low-Modus dauerte die Ausführung von Haiku 5.5 7 Sekunden und kostete 0,0936 US-Cent, der Fahrradrahmen des Pelikans war noch relativ intakt. Im Max-Modus dauerte es 5 Minuten und 9 Sekunden, kostete aber nur 3,3826 US-Cent.

In der generierten Beschreibung trägt der weiße Pelikan einen roten Hut, seine langen orangefarbenen Beine stehen auf orangefarbenen Pedalen, ein grauer Flügel ist ausgestreckt, um den Lenker zu halten, sein großer Schnabel zeigt nach vorne, hinter ihm befinden sich weiße Geschwindigkeitslinien und über ihm sind Sonne und Wolken. Zum Vergleich: Der Pelikan, den Haiku 4.5 vor einem Jahr gezeichnet hat, hatte „einen runden gelbbraunen Körper und einen rosa Schnabel“, was im Grunde falsch war.

Der AI-Analyst @NFT_Chen hat einen Vergleichstest für eine SVG-Grafik von Zebras in der Steppe durchgeführt.

Die von Haiku generierten Zebras haben Streifen, die dem Verlauf des Körpers folgen, beim Laufen sind die Vorder- und Hinterbeine versetzt, die nahen Gräser haben Schichten, die fernen Bäume liegen auf dem Bergrücken, und wenn das Zebra in das Gras tritt, entstehen Staub und Schatten. Bei den Zebras von Luna hingegen „durchziehen wirre Linien den Bauch, der Bauch ist zu einer Ellipse aufgebläht, die Beine ragen wirr wie Holzstäbchen hervor“, die Bäume im Hintergrund sehen aus wie aufgeklebte Silhouetten, das Zebra schwebt in der Mitte des Bildes und passt nicht zum Gras.

@NFT_Chen fasste zusammen: „Auf derselben Steppe läuft das eine, während das andere schwebt. Wettbewerb macht die Welt besser – vorausgesetzt, man zeichnet es erst einmal richtig!“

Aber nicht bei allen Tests hat Haiku gewonnen.

Das AI-Benchmark-Konto @bridgemindai hat einen Test mit einer Lavalampe durchgeführt. Haiku 5.5 „konnte den Test überhaupt nicht bestehen“, das generierte Ergebnis „hat kein Glas, keine Lava, sondern nur einen gelben Zylinder“. Es dauerte 4 Minuten und 34 Sekunden und kostete 0,03 US-Dollar. GPT-6 Luna hingegen erzeugte innerhalb von 42,8 Sekunden eine echte Lavalampe für weniger als einen US-Cent, also ist es mehr als 6 Mal schneller.

Der Raketenstart-Test von @bridgemindai ergab ähnliche Ergebnisse. Haiku benötigte 0,05 US-Dollar und 6 Minuten 58 Sekunden, um eine saubere Szene zu erstellen, während Luna dies für weniger als einen US-Cent und in 1 Minute 5 Sekunden erledigte – also 6 Mal schneller.

Die Rückmeldungen von Unternehmenskunden konzentrieren sich mehr auf praktische Szenarien. Aaron Vinh, Senior Software Engineer bei Asana, sagte, dass sie Haiku 5.5 für ihr Produkt AI Teammates einsetzen, um Aufgaben wie Bug-Klassifizierung, Projekteinrichtung und Suche in großen Projektportfolios zu bearbeiten. Die Verzögerung bei der Aufgabenerfüllung wurde um mehr als 30 % reduziert, und die Inferenzgeschwindigkeit pro Agentenrunde wurde maximal um das 2,5-fache verbessert.

Yashodha Bhavnani, Vice President of AI Products bei Box, erklärte, dass Haiku 5.5 11 Punkte mehr als Haiku 4.5 erreicht und nur etwa die Hälfte der Verzögerung aufweist, sodass es für groß angelegte Analysearbeiten wie Kostenberichte, Finanzübersichten und wöchentliche regelmäßige Rückblicke geeignet ist.

03

Die Überlegungen hinter der 90%igen Preissenkung

Das auffälligste Merkmal von Haiku 5.5 ist immer noch der Preis. Bei Anfragen mit weniger als 100.000 Token beträgt der Preis 0,1 US-Dollar pro Million Token für Eingaben, 0,5 US-Dollar für Ausgaben, nur 0,01 US-Dollar für das Lesen aus dem Cache und 0,125 US-Dollar für das Schreiben in den Cache. Im Vergleich zu Haiku 4.5 mit 1 US-Dollar für Eingaben und 5 US-Dollar für Ausgaben beträgt die Preissenkung 90 %.

Aber es gibt eine Schwelle: Bei mehr als 100.000 Token steigt der Preis von Haiku 5.5 auf das Fünffache: 0,5 US-Dollar für Eingaben, 2,5 US-Dollar für Ausgaben, 0,05 US-Dollar für Cache-Lesevorgänge und 0,625 US-Dollar für Cache-Schreibvorgänge. Trotzdem ist es immer noch 50 % günstiger als das Vorgängermodell.

Anthropic erklärte dazu, dass etwa 90 % aller Anfragen von Haiku 4.5 unter 100.000 Token liegen, sodass es für die meisten Benutzer direkt einer Preisnachlass von 90 % entspricht. Da der neue Tokenisierer etwa 25 % mehr Token verbraucht, beträgt die durchschnittliche Gesamteinsparung etwa 75 %.

Neben der Preissenkung von Haiku selbst hat Anthropic auch den Preis von Sonnet 5.5 angepasst. Der Cache-Lesepreis von Sonnet wurde von 0,2 US-Dollar pro Million Token auf 0,1 US-Dollar gesenkt, also genau halbiert. Da das Lesen aus dem Cache einen großen Anteil an der Arbeit von Agenten einnimmt, schätzt Anthropic, dass die Kosten für die meisten Agentenaufgaben um etwa 20 % gesenkt werden können.

Ein weiterer neuer Vorteil ist das API-Guthaben für Abonnenten: Max 5x-Benutzer erhalten 100 US-Dollar pro Monat, Max 20x-Benutzer 200 US-Dollar pro Monat und Team-Abonnenten maximal 500 US-Dollar (gemeinsam für das Team). Das Guthaben kann für jedes Modell auf der Plattform verwendet werden und entspricht genau dem Abonnementpreis selbst – das bedeutet, dass der gesamte Abonnementbetrag als API-Guthaben zurückerstattet wird. Willison bewertete dies als „wirklich großzügig“, was die Hürde für Abonnenten, die API zu nutzen, stark senkt. Das Guthaben ist nur im jeweiligen Monat gültig und wird nicht auf den nächsten Monat übertragen.