KI-Modellüberwachung in China: Beschleunigte Upgrades, sprunghaft angestiegene Nutzungsvolumina, der Cloud-Sektor tritt in einen neuen Aufwärtszyklus ein
Der chinesische Markt für KI-Modelle durchläuft derzeit eine intensive Phase technologischer Iterationen und eines explosionshaften Anstiegs der Nutzungsvolumina, wodurch die Investitionen in die Cloud-Computing-Infrastruktur in einen neuen Expansionszyklus eintreten.
Der neueste monatliche Überwachungsbericht für chinesische KI-Modelle, der von der Bank of America Merrill Lynch veröffentlicht wurde, zeigt, dass drei Hauptentwicklungen – die rasche Aktualisierung der Modelle im August, die zunehmende Knappheit der Rechenleistung und der starke Anstieg der kapitalintensiven Ausgaben im Cloud-Bereich – gleichzeitig verlaufen und gemeinsam das Bild der beschleunigten Übergangsphase der chinesischen KI-Industrie vom reinen Modellwettbewerb zur kommerziellen Verwertung zeichnen.
Was die neuesten Entwicklungen betrifft, so haben Cloud-Giganten wie Tencent und Alibaba sowie unabhängige KI-Labore wie DeepSeek und Zhipu im August in kurzer Folge neue Versionen ihrer Modelle vorgestellt, wobei einige Hersteller gleichzeitig die Preise für Tokens angehoben haben. Gleichzeitig beliefen sich die Kapitalausgaben von Tencent und Alibaba im zweiten Quartal auf 53 bzw. 68 Milliarden Yuan, und die Wachstumsrate der Cloud-Einnahmen beschleunigte sich deutlich: Bei Tencent lag der Anstieg im Jahresvergleich bei knapp über 20 %, bei Alibaba sogar bei 45 %.
Die Bank of America Merrill Lynch prognostiziert, dass die gesamten Kapitalausgaben der vier führenden chinesischen Cloud-Plattformen im Jahr 2026 um 98 % und im Jahr 2027 um 44 % im Jahresvergleich steigen werden. In den letzten 30 Tagen wurde die konsensuelle Erwartung des Marktes für die Kapitalausgaben von Tencent und Alibaba in den kommenden 12 Monaten um 25 % bzw. 29 % nach oben korrigiert, sodass der Marktraum für das Cloud-Geschäft vom Markt neu bewertet wird.
01 Die Welle der Modellaktualisierungen: Die Kluft zwischen China und den USA verkleinert sich, inländische Modelle führen bei den Nutzungsvolumina
Im August erlebte der chinesische Markt für KI-Modelle eine neue Runde intensiver Aktualisierungen. Auf Seiten der Cloud-Anbieter hat Tencent Hy4 preview vorgestellt, und Alibaba hat die Versionen Qwen 3.8 Max und Flash veröffentlicht. Auf Seiten der unabhängigen Labore hat Zhipu GLM5.3 Flash auf den Markt gebracht.
Aus den Fähigkeitsbewertungen geht hervor, dass sich die Kluft zwischen inländischen Modellen und dem weltweit Spitzenniveau stetig verkleinert. Laut Daten von Artificial Analysis belegt Claude Opus 5 von Anthropic mit 63 Punkten den ersten Platz des Intelligenzindex, gefolgt von Claude Fable 5 (62 Punkte) und GPT-5.6 Sol von OpenAI (61 Punkte). Unter den chinesischen Modellen belegt Kimi K3 von Moonshot AI mit 60 Punkten den fünften Platz weltweit, was 95 % der Punktzahl von Claude Opus 5 entspricht, und GLM-5.3 von Zhipu belegt mit ebenfalls 60 Punkten gemeinsam den sechsten Platz. Im Hinblick auf den Agentic Index liegen GLM-5.3 und Claude Opus 5 mit jeweils 59 Punkten gemeinsam auf dem ersten Platz, Qwen 3.8 Max von Alibaba belegt mit 58 Punkten den fünften Platz.
In der Bewertung für die Frontend-Webentwicklung und Programmierung (Code Arena WebDev) führt Claude Opus 5 mit 1691 Punkten, gefolgt von Kimi K3 (1674 Punkte) und Qwen-3.8 Max (1669 Punkte), während Tencent Hy4 preview mit 1633 Punkten den sechsten Platz belegt.
Die Nutzungsdaten bestätigen ebenfalls die starke Dynamik der inländischen Modelle. Laut Daten von OpenRouter steht DeepSeek V4 Flash bis zum 17. August mit insgesamt 31,6 Billionen Tokens an erster Stelle, gefolgt von Tencent Hy3 mit 26,2 Billionen Tokens, und MiMo-V2.5 von Xiaomi belegt mit 19,1 Billionen Tokens den dritten Platz. Nach Herstellerangaben führt DeepSeek mit einem wöchentlichen Anteil von 22 % an der Token-Nutzung, was einem Anstieg von 4,7 Prozentpunkten gegenüber dem gleichen Zeitraum im Juli entspricht.
Auf der KI-Plattform Vercel liegt der durchschnittliche monatliche Anteil von DeepSeek an der Token-Nutzung bei 29,7 %, was gegenüber 26,0 % im Juli weiter angestiegen ist, während Anthropic mit 24,7 % den zweiten Platz belegt. Bemerkenswert ist, dass obwohl DeepSeek bei den Nutzungsvolumina führend ist, Anthropic mit einem Anteil von 64,8 % an den Ausgaben nach wie vor absolut dominant ist, was auf deutliche Unterschiede bei der Preisgestaltung von Modellen aus China und den USA hinweist.
02 Differenzierung bei der Preisgestaltung: Knappheit der Rechenleistung treibt teilweise Preiserhöhungen voran, inländische Modelle behalten ihren Vorteil bei dem Preis-Leistungs-Verhältnis
Im August fiel der LLM-Token-Ausgabenindex im Monatsvergleich um 26 % auf 1,07 USD (im Juli lag er bei 1,45 USD), hat sich aber inzwischen stabilisiert.
Die Bank of America Merrill Lynch weist darauf hin, dass DeepSeek im August die Preise für Tokens angehoben hat, was die Bank jedoch auf die knappe Versorgung mit Rechenleistung zurückführt und nicht auf eine strategische Wende – also nicht auf eine Abkehr von der Linie „hohe Leistung zu niedrigen Kosten“, sondern auf ein kurzfristiges Ungleichgewicht zwischen Angebot und Nachfrage. Gleichzeitig tauchen weiterhin kleine, preiswerte Modelle wie GLM5.3 Flash von Zhipu auf, die dem Markt weitere Optionen mit hohem Preis-Leistungs-Verhältnis bieten.
Auf dem absoluten Preisniveau ist die Preisspanne zwischen Modellen aus China und den USA nach wie vor deutlich. Die Preise für Ein- und Ausgabe-Tokens von Claude Opus 5 betragen 5 USD bzw. 25 USD pro Million Tokens, bei GPT-5.6 Sol sind es 4 USD bzw. 20 USD. Unter den chinesischen Modellen hat Kimi K3 die höchste Preisgestaltung: 3 USD für Ein- und 15 USD für Ausgabe-Tokens, Qwen-3.8 Max liegt bei 2 USD bzw. 6 USD, und DeepSeek V4.0 kostet nur 0,7 USD bzw. 2 USD.
Auch bei den Kosten pro Aufgabe haben chinesische Modelle deutliche Vorteile. Laut Daten von Artificial Analysis betragen die Kosten pro Aufgabe mit einem Einheit des Intelligenzindex bei Claude Fable 5 bis zu 3,14 USD, bei Claude Opus 5 2,34 USD, während Qwen 3.8 Max nur 0,91 USD, Kimi K3 0,84 USD und GLM-5.3 nur 0,68 USD kosten.
03 Beschleunigung der Kapitalausgaben: Die Cloud-Infrastruktur tritt in eine neue Expansionsphase ein
Der explosionsartige Anstieg der Nutzungsvolumina von KI-Modellen treibt die Investitionen in die Cloud-Infrastruktur direkt voran.
Daten der Bank of America Merrill Lynch zeigen, dass die führenden chinesischen Internetplattformen seit 2024 kontinuierlich mehr in die KI-Infrastruktur investieren. Die gesamten Kapitalausgaben der vier großen Cloud-Plattformen beliefen sich 2025 auf fast 400 Milliarden Yuan, sollen 2026 auf 726 Milliarden Yuan ansteigen und 2027 die Marke von 1 Billion Yuan überschreiten.
Konkret für einzelne Unternehmen wird erwartet, dass die Kapitalausgaben von Alibaba im Geschäftsjahr 2026 68 Milliarden Yuan, von ByteDance 350 Milliarden Yuan, von Tencent 210 Milliarden Yuan und von Baidu 30 Milliarden Yuan betragen. In den letzten 30 Tagen wurde die konsensuelle Erwartung des Marktes für die Kapitalausgaben von Tencent und Alibaba in den kommenden 12 Monaten um 25 % bzw. 29 % nach oben korrigiert, und die Erwartungen für die Abschreibungen wurden gleichzeitig angehoben, was zeigt, dass der Markt höhere Investitionsintensitäten in die Bewertungssysteme einbezieht.
Was die Cloud-Einnahmen betrifft, so hat sich die beschleunigte Entwicklung in den Quartalsberichten des zweiten Quartals bestätigt: Die Einnahmen von Tencent Cloud stiegen im Jahresvergleich um knapp über 20 %, die von Alibaba Cloud um 45 %.
04 Aussichten für den Cloud-Markt: KI-getriebenes Wachstum, MaaS wird zum am schnellsten wachsenden Bereich
Die Bank of America Merrill Lynch prognostiziert, dass der chinesische Cloud-Markt von 389 Milliarden Yuan im Jahr 2025 auf 1,729 Billionen Yuan im Jahr 2030 anwachsen wird, was einer jährlichen durchschnittlichen Wachstumsrate von rund 38 % entspricht. Dabei werden die KI-bezogenen Cloud-Geschäfte (MaaS und KI-Infrastruktur) zum zentralen Wachstumsmotor.
Der Anteil des KI-Cloud-Marktes wird voraussichtlich von 17 % im Jahr 2025 auf 66 % im Jahr 2030 steigen. Dabei gilt KI-MaaS (Model as a Service) als das am schnellsten wachsende Teilsegment – es soll von 21 Milliarden Yuan im Jahr 2025 auf 676 Milliarden Yuan im Jahr 2030 anwachsen, mit einer jährlichen durchschnittlichen Wachstumsrate von bis zu 81 %. Das KI-Infrastruktur-Cloud-Geschäft (einschließlich GPU-Rechenleistung, Trainings- und Inferenzsystemen) wird voraussichtlich von 45 Milliarden Yuan im Jahr 2025 auf 470 Milliarden Yuan im Jahr 2030 ansteigen, was einer jährlichen durchschnittlichen Wachstumsrate von 51 % entspricht.
Was die Marktstruktur betrifft, so erwartet die Bank of America Merrill Lynch, dass Internetgiganten mit etabliertem Cloud-Geschäft wie Alibaba, Tencent und ByteDance stärker von dem Anstieg der Ausgaben für KI-Unternehmensdienste profitieren werden; unabhängige KI-Labore wie Zhipu und MiniMax verfügen über eine kleinere Einnahmenbasis und eine stärkere Ausrichtung auf ausländische Märkte, sodass sie zwischen 2026 und 2030 voraussichtlich noch höhere Wachstumsraten erzielen können.
05 KI-Anwendungsseite: Doubao führt kontinuierlich bei der Nutzerzahl, DeepSeek gewinnt an Nutzerbindung
Auf der Verbraucherseite erreichte die wöchentliche Zahl aktiver Nutzer (DAU) von Doubao, das zu ByteDance gehört, in der Woche zum 3. August 171,3 Millionen, mit einer gesamten Nutzungsdauer von 11,5 Milliarden Minuten, womit es unter den chinesischen KI-Chat-Anwendungen absolut führend bleibt. DeepSeek belegt den zweiten Platz mit 30,7 Millionen DAU und einer Nutzungsdauer von 3,8 Milliarden Minuten, Alibaba Qwen belegt den dritten Platz mit 28 Millionen DAU, und Tencent Yuanbao belegt den vierten Platz mit 8,7 Millionen DAU.
Was die Nutzerbindung betrifft, so stieg die durchschnittliche tägliche Nutzungsdauer pro Nutzer von DeepSeek in der Woche zum 3. August leicht auf 18 Minuten mit 8 Sitzungen pro Tag, während die durchschnittliche tägliche Nutzungsdauer und die Sitzungshäufigkeit von Doubao zwischen Juni und Juli deutlich zurückgingen.
Mit Blick auf die Zukunft hat die Bank of America Merrill Lynch mehrere wichtige Ereignisse zusammengestellt, die Aufmerksamkeit verdienen: Alibaba wird voraussichtlich während der Yunqi-Konferenz vom 22. bis 24. September neue Modelle vorstellen; MiniMax plant die Vorstellung von M3.1 und M3 Pro zwischen September und Oktober; Die neue Version von DeepSeek V5 und die aktualisierte Seed-Serie von ByteDance werden voraussichtlich in der zweiten Jahreshälfte 2026 vorgestellt; Die offizielle Version von Tencent Hy4 und die Vorschauversion von Hy5 sollen im vierten Quartal erscheinen. Darüber hinaus laufen die 12-monatigen Sperrfristen für Zhipu und MiniMax am 7. bzw. 8. Januar 2027 ab, wobei dann 40 % bzw. 90 % der Aktien freigegeben werden – ein Punkt, der die Aufmerksamkeit von Investoren verdient.
Dieser Artikel stammt aus dem WeChat-Offiziellen Konto „Hard AI“, Autor: Experte für Technologieforschung und -entwicklung, veröffentlicht mit Genehmigung von 36Kr.