Die fünf weltweit nach Aufrufvolumen führenden Großsprachmodelle sind allesamt chinesische Produkte, wobei Xiaomi MiMo-V2.5 die Spitzenposition einnimmt.
Kürzlich zeigte die wöchentliche Rangliste der globalen Aufrufvolumina von großen KI-Modellen, die von der Multi-Modell-Aggregationsplattform OpenRouter veröffentlicht wurde (20. Juli bis 26. Juli), dass die ersten fünf Plätze vollständig von großen Modellen eingenommen werden, die von chinesischen Unternehmen selbst entwickelt wurden, und die inländischen Modelle auf dem Markt für ausländische Entwickler hervorragende Leistungen erbringen.
An der Spitze der Rangliste steht Xiaomi MiMo-V2.5, dessen wöchentliches Aufrufvolumen 10,5 Billionen Tokens erreichte, was einem Anstieg von 12 % gegenüber der Vorwoche entspricht. Xu Jieyun, Sonderassistent des Vorstandsvorsitzenden der Xiaomi Group und stellvertretender General Manager der strategischen Marketingabteilung, hat diese Rangliste ebenfalls weiterverbreitet.
Dieses Modell von Xiaomi wurde am 23. April dieses Jahres offiziell in die öffentliche Testphase überführt und Ende April die gesamte Serie als Open-Source veröffentlicht. Es nutzt die Mixture-of-Experts (MoE)-Architektur, die Gesamtparameter überschreiten die Billionen-Grenze, die aktivierten Parameter betragen 42B, es ist standardmäßig mit einem extrem langen Kontextfenster von 1 Million Tokens ausgestattet und deckt gleichzeitig die gesamte Modaliätsinteraktion von Text, Sprache und Bild ab. Die geringen Inferenzkosten und die stabile Betriebsfähigkeit von Agenten sind die Kernvorteile, die ausländische Entwickler zur Massenintegration anziehen.
Die Modelle auf dem zweiten und fünften Platz stammen beide von DeepSeek, die beiden Modelle bilden eine Kombination für unterschiedliche Anforderungen und decken verschiedene Entwicklungsbedürfnisse ab. Das DeepSeek V4 Flash auf dem zweiten Platz erreicht ein wöchentliches Aufrufvolumen von 6,37 Billionen Tokens, was einem Anstieg von 18 % gegenüber der Vorwoche entspricht. Das DeepSeek V4 Pro auf dem fünften Platz erreicht ein wöchentliches Aufrufvolumen von 3,17 Billionen Tokens, was einem Anstieg von 17 % gegenüber der Vorwoche entspricht.
Die beiden oben genannten Produkte von DeepSeek wurden gleichzeitig am 24. April veröffentlicht, die gesamte Serie ist standardmäßig mit einem 1M-Kontext ausgestattet. Die leichtgewichtige Flash-Version hat Gesamtparameter von 284B und aktivierte Parameter von 13B, die auf kostengünstige und schnelle Inferenz abzielt. Die Flaggschiff-Pro-Version hat Gesamtparameter von 1,6T und 49B aktivierte Parameter, ihre Leistung bei Codeaufgaben und komplexen Agentenaufgaben steht im Vergleich zu den besten geschlossenen Modellen aus dem Ausland, und sie verwendet die vollständig offene MIT-Lizenz.
Tencent Hunyuan Hy3 belegt den dritten Platz, sein wöchentliches Aufrufvolumen beträgt 3,94 Billionen Tokens, mit einem Anstieg von über 999 % gegenüber der Vorwoche, es ist das Modell mit dem stärksten Wachstumstrend in der Rangliste. Dieses Modell wurde am 6. Juli offiziell als Open-Source veröffentlicht, es hat Gesamtparameter von 295B und aktiviert nur 21B Parameter bei einer einzelnen Inferenz. Es verwendet eine Fusionsarchitektur aus schnellem und langsamem Denken, unterstützt maximal 256K Kontext, seine Fähigkeiten zur Codegenerierung und intelligenten Interaktion wurden erheblich verbessert, und nach drei Wochen der Open-Source-Veröffentlichung hat sein ausländisches Aufrufvolumen ein explosives Wachstum erreicht.
Das Zhipu AI GLM 5.2 auf dem vierten Platz erreicht ein wöchentliches Aufrufvolumen von 3,29 Billionen Tokens, was einem Rückgang von 10 % gegenüber der Vorwoche entspricht. Dieses Modell wurde am 15. Juni vollständig als Open-Source veröffentlicht, das Grundgerüst mit 753B Parametern zielt auf die Verarbeitung von langfristigen technischen Aufgaben ab und steht in den spezialisierten Bewertungen für Code und Datenanalyse in der ersten Reihe der Open-Source-Modelle.
Im Gegensatz zu den Daten für die interne Nutzung von Unternehmen aggregiert die OpenRouter-Plattform die echten kostenpflichtigen Aufrufanforderungen von zehntausenden unabhängigen Entwicklern im Ausland sowie kleinen und mittleren KI-Anwendungen im Ausland. Alle Tokennutzungen folgen einem einheitlichen Messstandard, was die echte Wahl der globalen Entwickler objektiv widerspiegeln kann. Das bedeutet auch, dass inländische Open-Source-Modelle die ökologischen Barrieren ausländischer Hersteller durchbrechen und in vollständig marktorientierten Drittkanälen eine Spitzenposition einnehmen.
Die Rangliste weist jedoch auch Grenzen auf. Der Datenverkehr aus den eigenen Apps großer inländischer Internetunternehmen, der privatisierten Bereitstellung von Unternehmen und den geschlossenen APIs großer US-Unternehmen wird nicht erfasst, sodass er nicht das gesamte globale KI-Aufrufvolumen vollständig repräsentieren kann, sondern nur als Beobachtungsfenster für die ausländische Open-Source-Szene dient.
Neben der Aufrufvolumen-Rangliste von OpenRouter gibt es in der KI-Branche zwei weitere häufig erwähnte Bewertungsranglisten, die sich jeweils auf die umfassende Leistung und das Kampferlebnis mit echten Nutzern konzentrieren.
Die eine ist die Rangliste der Chatbot Arena, die die umfassenden Fähigkeiten der Modelle bei Dialog und Inferenz anhand von Elo-Bewertungen aus Blindtests mit echten Nutzern beurteilt. In der jüngsten Rangliste vom Juli gehören DeepSeek V4 und GLM 5.2 zu den ersten fünf der Open-Source-Modelle. Die andere ist die umfassende technische Bewertungsrangliste von Artificial Analysis, die standardisierte Tests in allen Dimensionen wie Code, Mathematik, Logik und Langtext abdeckt. Mehrere inländische Open-Source-Modelle brechen kontinuierlich die Höchstwerte in der Open-Source-Szene, aber die Obergrenze der umfassenden Leistung wird immer noch von den geschlossenen Modellen der Claude- und GPT-Serie aus den USA gehalten.
Die Daten der beiden oben genannten Ranglisten zeigen, dass inländische Modelle bei dem marktorientierten genutzten Datenverkehr die Führung übernommen haben, aber bei der harten umfassenden Inferenzfähigkeit besteht noch ein kleiner generationsbedingter Unterschied.
Bemerkenswert ist, dass Jensen Huang, CEO von NVIDIA, kürzlich bei der Diskussion über die Leistung der KI-Technologie in China und den USA sagte: „Hervorragende Talente finden immer ausgezeichnete Antworten, und China ist dazu bestimmt, herausragende KI-Technologien hervorzubringen. Wir sollten weiterhin von ihnen lernen und mit ihnen zusammenarbeiten.“
Er sprach sich auch gegen das Verbot chinesischer KI-Modelle durch die USA aus, meinte, dass die chinesischen KI-Modelle sehr hervorragend seien, und erklärte: „Der Markt hat zunächst die Auswirkungen von DeepSeek falsch verstanden und dann erneut Kimi falsch eingeschätzt.“
Das neueste veröffentlichte K3 von Kimi belegt in der wöchentlichen Rangliste von OpenRouter vorläufig den 10. Platz. Dieses Modell hat Gesamtparameter von 2,8 Billionen und ist mit einem extrem langen Kontextfenster von 1 Million Tokens ausgestattet, es ist derzeit das Open-Source-Modell mit der größten Parametergröße weltweit.
Der weltweit reichste Mensch Elon Musk hat in letzter Zeit Kimi kontinuierlich beobachtet. Im März dieses Jahres veröffentlichte Moonshot AI das Papier „Attention Residuals“, das einen „Attention Residual“-Mechanismus vorschlägt, um die Restverbindungen in der traditionellen Transformer-Architektur zu ersetzen. Zu dieser Zeit verbreitete Musk den Beitrag auf der sozialen Plattform und kommentierte: „Kimi's work is impressive“. Moonshot AI antwortete humorvoll: „Deine Raketen sind auch gut gebaut!“
Nach der Veröffentlichung von Kimi K3 hinterließ Musk sofort die kurze Bewertung „Impressive“ im Kommentarbereich des relevanten Bewertungsberichts, bestätigte erneut die technischen Fähigkeiten von Moonshot AI und enthielt aktiv Informationen zu Grok 4.6, um mit Kimi zu konkurrieren.
Am 25. Juli berichtete The Paper, dass Elon Musk in einem Interview mit The Economist sagte, dass China zu einem bestimmten Zeitpunkt in der Zukunft sehr wahrscheinlich zum KI-Führer werden wird, und selbst wenn die USA chinesische Modelle verbieten, können sie diesen Trend nicht aufhalten.
Allerdings ist die Spitzenposition beim Datenverkehr nur der Ausgangspunkt. Um den Sprung von der „Führung bei der Nutzungsmenge“ zur „umfassenden Führung bei der Technologie“ zu schaffen, muss die inländische KI-Industrie in vielen Dimensionen wie unabhängiger Rechenleistung, zugrundeliegender Ökologie und zukunftsweisender Innovation kontinuierlich Fortschritte machen, um die hart erarbeitete Marktposition durch langfristige technische Akkumulation zu festigen.
Dieser Artikel stammt von „Jiemian News“, der Autor ist Song Jianan, 36Kr veröffentlicht ihn mit erteilter Genehmigung.