Anthropics neues Modell schnappt heimlich alle Klatschinhalte auf, das leistungsstärkste Fable 5 sorgt für eine unerwartete Sensation.
Anthropic hat zwei weitere „neue Karten“, die vorzeitig aufgedeckt wurden!
Heute sind in Anwendungen von Drittentwicklern und der Discord-Community nacheinander zwei unbekannte Modell-IDs aufgetaucht –
- claude-mashmallow-eap (Marshmallow)
- claude-melon-eap (Melone)
Frühe praktische Testergebnisse sind durchgesickert: Marshmallow zeigt eine stärkere Leistung, die Natürlichkeit der Konversation übertrifft sogar Opus 5, während Melon etwas schlechter abschneidet.
Ihre Gesamtleistung erreicht jedoch nicht das „Fable-Niveau“, und sie werden voraussichtlich bereits nächste Woche online gestellt.
Während das gesamte Netzwerk über die Neuigkeiten diskutiert, ist intern bei Anthropic bereits eine „Bombe“ geplatzt –
Fable 5 ist seit über zwei Monaten online, wurde aber fast von allen Seiten ignoriert.
Anthropic ergänzt dringend neue Modelle
Neue Claude-Modelle aufgedeckt
Dieses Update scheint eiliger als je zuvor zu kommen.
Experten im KI-Bereich vermuten, dass Marshmallow höchstwahrscheinlich die iterative Aktualisierung auf Opus-Niveau darstellt und möglicherweise genau Opus 5.1 ist.
Melon hingegen liegt eher auf dem Niveau von Sonnet.
Ein von einem Nutzer veröffentlichtes SVG-Testergebnis vergrößert den Abstand zwischen den beiden Modellen weiter.
Die offizielle Seite von Anthropic hat bisher noch keine formelle Antwort gegeben, aber alle möglichen Hinweise laufen bereits zusammen.
Wenn es sich nur um eine normale Aktualisierung handelt, ist diese Sache an sich nicht überraschend.
Der wirklich heikle Punkt ist: Warum ausgerechnet jetzt?
Schließlich hat Anthropic vor etwas mehr als zwei Monaten erst seine stärkste und teuerste Karte auf den Tisch gelegt.
Das ist Fable 5, das an der Spitze der Claude-Produktpalette steht.
Das stärkste Fable 5 erleidet einen unerwarteten Misserfolg
Vor zwei Monaten trat Fable 5 mit dem Ruf als „stärkstes Flaggschiff“ von Anthropic auf.
Es hat die stärkste Leistung, den höchsten Preis und ist gleichzeitig das leistungsstärkste KI-Modell in der gesamten Claude-Produktlinie.
Nach der üblichen Branchenpraxis verlagern große Unternehmen nach der Veröffentlichung eines neuen Flaggschiffs schnell ihre Ressourcen und lenken das Budget auf das neueste und leistungsstärkste Modell.
Diesmal hat diese Regel bei Fable 5 nicht gegriffen!
Die Zahlungsplattform Ramp hat die Token-Ausgabendaten von über 70.000 Unternehmen in den USA verfolgt, und die Ergebnisse zeigen:
Einen Monat nach der Veröffentlichung von Fable 5 machte es nur 6 % des gesamten Token-Aufrufvolumens der Unternehmen bei Anthropic aus, und der Anteil der Ausgaben betrug 11,4 %.
Jetzt, nach etwas mehr als zwei Monaten, zeigen die neuesten Daten von FT, dass dieser Ausgabenanteil immer noch bei etwa 11 % liegt.
Das heißt, nur sehr wenige Entwickler und große Unternehmen sind wirklich bereit, ihre Modelle auf Fable 5 umzustellen.
Das Flaggschiff-Modell GPT-5.6 Sol von OpenAI hat im gleichen Zeitraum 25 % der Token und 23 % der Ausgabenanteile übernommen.
Auf dem gleichen Markt beträgt der Anteil des Top-Modells von Anthropic nur ein Viertel des Konkurrenten.
Noch peinlicher ist, dass der Gesamtumsatzbeitrag von Fable 5 nur etwa 75 % von GPT-5.6 Sol beträgt, obwohl jeder Token doppelt so teuer ist.
Wie hoch ist der Preis genau?
Der Stückpreis von Fable 5 ist doppelt so hoch wie der von Anthropics eigenem Opus 4.8 und zehnmal so hoch wie der von Haiku 4.5.
Obwohl es leistungsstark ist, erreichen die täglichen Szenarien der meisten Unternehmen dieses Niveau überhaupt nicht.
Das eigene Opus 5 übertrifft das Flaggschiff
Ein anderes Modell von Anthropic ist der „direkte Angriff“ auf Fable 5.
Ende Juli wurde Opus 5 offiziell vorgestellt, dessen Preis nur halb so hoch wie der von Fable 5 ist, aber bei Tests in Programmierung und wissensintensiven Arbeiten erzielte es sogar bessere Ergebnisse.
Die Testergebnisse von CursorBench 3.2 sind noch direkter –
Opus 5 erreicht unter maximaler Rechenleistung eine Punktzahl von 70 % bei Kosten von 8,23 US-Dollar pro Aufgabe. Fable 5 erreicht eine Punktzahl von 70,5 %, also 0,5 Prozentpunkte mehr, kostet aber 17,32 US-Dollar.
Das bedeutet, dass man für das Doppelte an Geld nur 0,5 % mehr an Leistung erhält.
Das Ergebnis der Entscheidung der Unternehmen ist nicht überraschend: Laut Ramp-Daten hat der Ausgabenanteil von Opus 5 nach seiner Veröffentlichung den von Fable 5 schnell übertroffen.
Aber das Problem lautet: Wenn das Flaggschiff-Modell nur ein „Ausstellungsstück“ ist, warum sollte der Markt dann eine Bewertung von 2 Billionen US-Dollar vergeben?
Open-Source-Anteil steigt von 11 % auf 62 % in nur vier Monaten
Darüber hinaus setzt die rasante Expansion von Open-Source-KI Anthropic stark unter Druck.
Statistiken von Vercel AI Gateway zeigen –
Im April betrug der Token-Anteil von Open-Source-Modellen nur 11 %. Im Juni stieg diese Zahl sprunghaft auf 29 %. Die neuesten Daten vom August zeigen einen Anteil von 62 %.
In nur zwei Monaten ist der Anteil von unter 30 % auf über 60 % gestiegen, während die dafür ausgegebenen Gelder weniger als 4 % der gesamten Unternehmensausgaben ausmachen.
Das heißt, die Modelle, die den Großteil der Arbeit erledigen, kosten fast nichts.
Das macht die Position von Fable 5 immer unangenehmer.
Intern betrachtet kann Opus 5 mit nur halbem Preis bereits fast das Niveau von Fable 5 erreichen. Nach außen hin drücken Open-Source-Modelle den Preis immer weiter nach unten.
Fable 5 kann natürlich weiterhin die Obergrenze der Leistungsfähigkeit ausloten.
Aber was Anthropic derzeit dringender braucht, ist ein Modell, das Unternehmen wirklich bereit sind, langfristig und in großem Umfang zu nutzen.
So betrachtet ist das plötzliche Auftauchen von Marshmallow und Melone nicht mehr so überraschend.
Sie füllen möglicherweise genau den wichtigsten Teil in der gesamten Claude-Modellpalette aus –
Es muss leistungsstark und gleichzeitig erschwinglich sein; es kann Stärke zeigen, aber vor allem muss es von den Nutzern akzeptiert werden.
Referenzmaterialien:
https://x.com/kimmonismus/status/2091599817084412221?s=20
https://www.ft.com/content/5ee49718-c258-4f01-aa32-7e5b76ae5245?syn-25a6b1a6=1
Dieser Artikel stammt aus dem WeChat-Offiziellen Konto „New Zhiyuan“, Autor: ASI Offenbarung, Redakteur: Taozi, veröffentlicht mit Genehmigung von 36Kr.