Das mit der Tsinghua-Universität verbundene KI-Video-Einhorn plant einen Börsengang in Hongkong.
Shengshu Technology, ein Hersteller von generativer KI, der von Professor Zhu Jun der Tsinghua-Universität gegründet wurde und von Alibaba stark unterstützt wird, soll Berichten zufolge die Vorbereitungen für die Börsennotierung an der Hongkonger Börse aufgenommen haben.
Am 18. August berufen sich mehrere Medien auf Nachrichten von informierten Kreisen, dass Shengshu Technology einen Börsengang in Hongkong erwägt. Das geplante Finanzierungsvolumen übersteigt 500 Millionen US-Dollar (ca. 3,9 Milliarden Hongkong-Dollar). Derzeit arbeitet es mit China International Capital Corporation und CITIC Securities im Zusammenhang mit dem Börsengang zusammen. Es wird erwartet, dass der Antrag im nächsten Jahr offiziell eingereicht wird.
Auf die oben genannten Gerüchte hin erklärten Shengshu Technology, CICC und CITIC Securities, keine Stellungnahme abzugeben.
Die Signale für die Vorbereitungen des Börsengangs wurden bereits früher gesendet. Am 30. März dieses Jahres hat das Hauptunternehmen die Umwandlung in eine Aktiengesellschaft abgeschlossen und den Namen von „Beijing Shengshu Technology Co., Ltd.“ in „Beijing Shengshu Technology Co., Ltd. (nicht börsennotiert)“ geändert. Bereits im April gab es Marktnachrichten, dass das Unternehmen den Prozess des Börsengangs an der Hongkonger Börse frühestens im ersten Halbjahr 2026 starten wird.
01
Shengshu Technology wurde im März 2023 gegründet. Gründer Zhu Jun ist Professor am Institut für Informatik der Tsinghua-Universität, IEEE Fellow und gleichzeitig stellvertretender Direktor des Instituts für Künstliche Intelligenz der Tsinghua-Universität sowie Direktor des Staatlichen Schlüssellabors für intelligente Technologie und Systeme. Das von ihm geführte Kern-Gründungsteam gehört zu den weltweit ersten Forschungsgruppen, die sich tief mit tiefen probabilistischen Generierungsmodellen befassen, was dem Unternehmen einen deutlichen technischen Hintergrund der Tsinghua-Universität verleiht.
In den drei Jahren seit seiner Gründung hat sich das Finanzierungstempo des Unternehmens stetig beschleunigt. Allein seit Anfang 2026 hat es drei wichtige Finanzierungsrunden abgeschlossen.
Im Februar schloss es eine A+-Finanzierungsrunde mit über 600 Millionen Yuan ab. Im April erhielt es eine B-Finanzierungsrunde von fast 2 Milliarden Yuan, die von Alibaba Cloud angeführt wurde, gefolgt von Investitionsinstitutionen wie China Investment Corporation, Jiu'an Haitang und TAL Education. Die Bewertung nach der Investition übersteigt 2 Milliarden US-Dollar. Innerhalb von zwei Monaten sammelte es insgesamt mehr als 2,6 Milliarden Yuan ein. Im Juli schloss es eine neue Finanzierungsrunde von 500 Millionen US-Dollar ab und stellte damit den Rekord für die höchste Einzelinvestition im Bereich der allgemeinen Weltmodelle in China auf.
Was das Aktionärsportfolio betrifft, ist die Alibaba-Gruppe kein späterer Einsteiger – nur drei Monate nach der Gründung des Unternehmens im Jahr 2023 führte Ant Group die Angel-Runde an. Baidu Ventures und Qiming Venture Partners sind frühe Aktionäre, die kontinuierlich mitinvestiert haben. Gleichzeitig wurden staatliche industrielle Kapitalquellen wie Zhongguancun Science City eingeführt, sodass die Aktionärsstruktur Industrie-, Finanz- und staatliche Ressourcen abdeckt.
Auf technischer und produktspezifischer Ebene begann Shengshu Technology mit der Videogenerierung und erweitert sich schrittweise auf Weltmodelle und körperliche Intelligenz.
Im April 2024 veröffentlichte das Unternehmen das erste große Videomodell Vidu, das zum ersten textgenerierten Videoprodukt in China wurde, das Sora umfassend entspricht. Das im April 2025 eingeführte aktualisierte Modell Vidu Q1 übertraf in den maßgeblichen Bewertungsmaßstäben für Videogenerierung VBench-1.0 und VBench-2.0 beide Modelle wie Runway, OpenAI Sora und Kuaishou Keling und belegte den ersten Platz in beiden Ranglisten der textgenerierten Videobranche.
Auf kommerzieller Ebene überschritt der jährliche wiederkehrende Umsatz (ARR) von Vidu nach 8 Monaten seit der Markteinführung 20 Millionen US-Dollar (ca. 140 Millionen Yuan). Die Nutzer verteilen sich auf mehr als 200 Länder und Regionen weltweit. Im Jahr 2025 wuchs sowohl die Nutzerzahl als auch der Umsatz um mehr als das Zehnfache im Vergleich zum Vorjahr.
Derzeit ist Vidu in vielen Branchen wie Werbung, E-Commerce, Animation, Kultur und Tourismus, Rundfunk und Bildung angekommen und hat eine tiefe Zusammenarbeit mit Unternehmensplattformen wie Feishu erreicht. Mit Generierungskosten von nur 1,34 Yuan für ein 5-Sekunden-Video in 1080P ist sein Kostenvorteil die Kernunterstützung für das schnelle kommerzielle Wachstum.
Im Juli 2026 veröffentlichte das Unternehmen das Modell Vidu S1 für Echtzeit-Interaktionsszenarien, das Echtzeit-Videoanrufe und sprachgesteuerte Videoverläufe unterstützt. Nutzer können das Verhalten von digitalen Menschen über Sprachbefehle steuern und eine kontinuierliche Interaktion von unbegrenzter Dauer erreichen.
02
Neben der Videogenerierung erweitert Shengshu Technology seine technische Basis auf den Bereich der körperlichen Intelligenz in der physischen Welt.
Im Dezember 2025 veröffentlichte das Unternehmen gemeinsam mit der Tsinghua-Universität das allgemeine Basismodell Motus, das als „Gehirn“ für die körperliche Intelligenz in der realen Welt positioniert ist. Das im April 2026 eingeführte Motubrain belegte den ersten Platz in zwei internationalen maßgeblichen Benchmarks, WorldArena (Weltmodellierungsfähigkeit) und RoboTwin 2.0 (Aufgabenausführungsfähigkeit). Mit einer durchschnittlichen Erfolgsrate von 95,8 % erneuerte es den SOTA-Rekord. Es ist das einzige Modell in der Liste, das unter zufälligen Störungsumgebungen einen Durchschnittswert von über 95 erreicht, und verfügt über die Generalisierungsfähigkeit über verschiedene Roboter und Aufgabenszenarien hinweg.
Mit der homologen technischen Basis der tiefen probabilistischen Generierungstechnologie gehört Shengshu Technology zu den wenigen Herstellern in China, die gleichzeitig sowohl die KI-Videogenerierung als auch die Weltmodelle für körperliche Intelligenz abdecken. Die technische Wiederverwendbarkeit ist deutlich höher als bei Unternehmen, die nur in einem einzelnen Bereich tätig sind.
03
Hinter dem schnellen Wachstum sind der Wettbewerb in der Branche und die kommerziellen Herausforderungen ebenso klar.
Die Branche der KI-Videogenerierung ist in eine Phase des Wettbewerbs zwischen großen Unternehmen eingetreten. Führende Akteure wie Kuaishou Keling, ByteDance Seedance und Tencent Hunyuan haben alle ausgereifte Produkte auf den Markt gebracht, und der Wettbewerb in der Branche verschärft sich ständig. Auch in der Branche der körperlichen Intelligenz sind Dutzende von Teilnehmern eingetreten, sodass Unsicherheiten hinsichtlich des Fortschritts der Umsetzung und des kommerziellen Tempos bestehen.
Im Vergleich zu großen Textmodellen sind die kommerziellen Hürden für die Videogenerierung höher: Urheberrechte an Trainingsdaten, Einhaltung der Content-Sicherheitsvorschriften, Konsistenz von Generierungsdauer und Bildqualität sowie die Kontrolle der Inferenzkosten sind alles Kernfaktoren, die die großflächige Umsetzung behindern. Gleichzeitig ist die Gewohnheit der Endnutzer, für große Videomodelle zu bezahlen, noch in der Phase der Förderung, und die Nutzerbindung und die Umwandlung in zahlende Nutzer wurden noch nicht langfristig validiert. Der Umsetzungszyklus für das Geschäft mit körperlicher Intelligenz ist länger, sodass es kurzfristig kaum skalierbare Einnahmen liefern kann. Das Wachstum der Unternehmensleistung hängt nach wie vor stark von dem einzelnen Bereich der Videogenerierung ab.
Wenn die geplante IPO-Finanzierung von über 500 Millionen US-Dollar erfolgreich abgeschlossen wird, wird Shengshu Technology das erste Unternehmen in der chinesischen Videogenerierungsbranche, das an den Kapitalmarkt geht. Ob die starken technischen Barrieren des Unternehmens in eine nachhaltige und stabile Rentabilität umgewandelt werden können, wird das Kernthema sein, auf das der Markt nach dem Börsengang achtet.