Jensens neueste Äußerung zu KI
Am frühen Donnerstagmorgen, chinesischer Zeit, hat NVIDIA, das Unternehmen mit der höchsten Marktkapitalisierung weltweit, seine jährliche Hauptversammlung abgehalten. Huang Renxun, ein führender Charakter in der KI-Branche, hat auf der Hauptversammlung erklärt, dass die Frage nach der Rendite von KI-Investitionen „schon beantwortet“ sei.
Bei der Unternehmensaktualisierung betonte Huang Renxun immer wieder, dass KI-Datenzentren „Tokenfabrikken“ seien. Tokens könnten zu Code, Antworten, Entwürfen, Aktionen und Dienstleistungen werden. Jeder Token ist daher eine Gewinneneinheit.
Darin steckte auch der marktbewegendste Satz seiner gesamten Ansprache: Nützliche KI ist da, und sie ist rentabel (Useful AI has arrived, and it is profitable).
Huang Renxun betonte gleichzeitig, dass das NVIDIA-System möglicherweise nicht das preiswerteste beim Kauf sei, aber es könne die Token mit den geringsten Kosten und den höchsten Token-Durchsatz – sowie das höchste Einkommen – generieren.
Mit anderen Worten, die Kunden von NVIDIA kaufen nicht nur eine Reihe von Servern, sondern bauen KI-Fabriken, die Einkommen generieren können.
Diese Logik stützt auch die erstaunlichen finanziellen Ergebnisse von NVIDIA. Das Unternehmen hat ein Jahreseinkommen von 216 Milliarden US-Dollar erzielt, was einem Anstieg von 65 % entspricht. Der Betriebsgewinn ist um 60 % auf 130 Milliarden US-Dollar gestiegen. Die Betriebsgeldflüsse beliefen sich auf 103 Milliarden US-Dollar, und es wurden 41 Milliarden US-Dollar an die Aktionäre zurückgegeben. Dabei ist das Einkommen aus den Datenzentren um 68 % auf 194 Milliarden US-Dollar gestiegen.
Als Wachstumsmotor für die nächste Phase von NVIDIA hat die Vera Rubin-Architektur nun die volle Serienproduktion erreicht.
Huang Renxun sagte, Hopper sei für das Prätraining gemacht, Blackwell habe die Inferenz auf Racks-Ebene gebracht, und Vera Rubin sei für Agenten entwickelt. Agenten müssen ständig denken, auf Datenbanken zugreifen, Tools aufrufen und Code ausführen. Wenn die CPU nicht mithalten kann, bleibt die GPU untätig. Und in einer KI-Fabrik bedeutet untätige GPU Einkommensverlust.
Neben den KI-Fabriken bezeichnet Huang Renxun auch die „physische KI“ als die nächste Wachstumswelle. Er meint, Roboter, Autos und Fabriken werden in der realen Welt zu Agenten, die wahrnehmen, schließen, planen und eigenständig handeln können. NVIDIA wird über die KI-Fabriken Modelle trainieren, mit Omniverse simulieren und dann über Rechenplattformen wie Jetson die Modelle auf Robotern und Geräten laufen lassen.
Huang Renxun äußerte sich auch optimistisch in Bezug auf das langfristige Wachstum und die Auswirkungen von ASICs. Er betonte, dass dieser Bauplan auf einer Skala von Jahrzehnten gemessen werde und dass die Infrastruktur von NVIDIA „die beste Inferenzökonomie“ bieten könne.
In Bezug auf die Rendite für die Aktionäre sagte Huang Renxun, dass es die Planung sei, in diesem Jahr, im nächsten Jahr und in Zukunft 50 % oder mehr der freien Cashflows an die Aktionäre zurückzugeben.
Die Abstimmungen auf der jährlichen Hauptversammlung verliefen insgesamt unauffällig. Die Aktionäre haben in einer beratenden Abstimmung das Vorstandsvergütungsprogramm des Unternehmens genehmigt und die Wiederwahl aller zehn Verwaltungsratsmitglieder befürwortet. Eine weitere Antrag von außenständigen Aktionären wurde angenommen. Dieser Antrag fordert die Änderung der Satzung, so dass alle Aktionärsabstimmungen mit einfacher Mehrheit entschieden werden können.
Im Folgenden finden Sie die vollständigen Protokolle der Unternehmensaktualisierung von Huang Renxun und der Fragen-Antwort-Session auf der NVIDIA-Hauptversammlung (KI-unterstützte Übersetzung, Teile wurden gekürzt)
Unternehmensaktualisierung von Huang Renxun (Business Update)
Für NVIDIA und die gesamte Computerbranche war dies ein außergewöhnliches Jahr. Alle 10 bis 15 Jahre durchläuft die Computerbranche einen Umbruch: Von den Großrechnern zu den PCs, von den PCs zum Internet, vom Internet zur Cloud und von der Cloud zur mobilen Cloud. Und diesmal ist der Umbruch noch größer.
In den letzten 60 Jahren haben Menschen Software geschrieben, und Computer haben Befehle ausgeführt. Dieses Paradigma hat sich geändert. Mit Hilfe von KI können Computer verstehen, schließen, planen, Tools nutzen und nützliche Arbeit leisten. Computer sind nicht mehr nur ein Werkzeug. In der KI-Ära ist es ein Assistent, der Werkzeuge nutzen kann. Daraus folgt, dass Datenzentren nicht mehr nur eine „Werkzeugablage“ sind, sondern eine KI-Fabrik aus digitalen Assistenten, eine Infrastruktur zur Produktion digitaler Intelligenz.
NVIDIA baut die Recheninfrastruktur für diese neue Ära auf.
Vor zwei Jahren hat die generative KI die Aufmerksamkeit der Welt auf sich gezogen. ChatGPT kann schreiben, zeichnen, zusammenfassen und Fragen beantworten. Dann hat die inferenzfähige KI gelernt, Fragen zu denken. Jetzt ist die Agenten-KI da. Agenten können Tools nutzen, auf Gedächtnis zugreifen, Code schreiben, andere Agenten aufrufen, Ergebnisse testen und weiterarbeiten, bis die Aufgabe erledigt ist.
Die Softwareprogrammierung ist die erste bedeutende Durchbruchsanwendung auf der Unternehmensseite. Das ist wichtig: KI ist jetzt nützlich. Wenn KI nützliche Arbeit leisten kann, wird der Token wertvoll. Wenn Tokens Profit bringen können, beschleunigt sich der Bedarf an Rechenleistung.
Schauen wir uns die Beweise an. GitHub-Entwickler haben 2023 300 Millionen Pull Requests zusammengeführt (Pull Request bedeutet wörtlich „Pull-Anfrage“, was bedeutet, dass ein Programmierer nach dem Schreiben eines Codes eine Anfrage an das Projekt stellt: „Bitte füge meinen Code ein“), 2024 waren es 400 Millionen und 2025 500 Millionen, was einen klaren und stabilen Aufwärtstrend zeigt. Aber in den ersten Monaten von 2026 hat sich diese Geschwindigkeit fast verdreifacht. Offensichtlich bedeutet dies, dass die rund 30 Millionen Softwareentwickler weltweit – die jährlich etwa 3 Billionen US-Dollar an Gehältern erhalten und deren Arbeit die globale Wirtschaft von 100 Billionen US-Dollar stützt – von KI verstärkt werden. Mit Hilfe von Agenten schafft dieselbe Arbeitskraft jetzt einen Output von fast 9 Billionen US-Dollar, was einem Anstieg von 6 Billionen US-Dollar entspricht.
Die Programmierung ist nur einer der Bedarfsantreiber. Nützliche KI ist da. Die Frage nach der Rendite von KI-Investitionen ist beantwortet, und Branchen aller Art konkurrieren darum, die Agenten-KI zu adoptieren.
Das Einkommen von NVIDIA ist um 65 % auf 216 Milliarden US-Dollar gestiegen. Der Betriebsgewinn ist um 60 % auf 130 Milliarden US-Dollar angestiegen. Der Gewinn pro Aktie nach Abzug der Dilution ist um 67 % auf 4,90 US-Dollar gestiegen. Wir haben Betriebsgeldflüsse von 103 Milliarden US-Dollar generiert und 41 Milliarden US-Dollar an die Aktionäre zurückgegeben.
Das Einkommen aus den Datenzentren betrug 194 Milliarden US-Dollar, was einem Anstieg von 68 % entspricht. Blackwell hat die Reichweite der NVIDIA-Infrastruktur bei verschiedenen Kundenstämmen erheblich erweitert, einschließlich Superskalen-Cloud-Anbietern, Cloud-Dienstleistern, KI-Labors, Industrieunternehmen und souveränen Kunden. Modellentwickler und Superskalen-Cloud-Anbieter haben bereits Hunderttausende von Blackwell-GPUs installiert. Der Bau von KI-Fabriken erweitert sich weiterhin rasch in allen wichtigen Branchen. Unternehmen wie Capital One, Hyundai Motor Group, Jane Street und Eli Lilly erweitern die NVIDIA-Infrastruktur, um KI zu deployen.
Das internationale Einkommen ist mehr als verdreifacht und liegt bei über 30 Milliarden US-Dollar. Fast 40 Länder/Regionen, die insgesamt 50 Billionen US-Dollar an BIP repräsentieren, bauen KI-Fabriken, die von der NVIDIA-Infrastruktur angetrieben werden.
Die KI-Infrastruktur ist nicht mehr experimentell, sondern hat die Produktionsphase erreicht. KI ist nicht nur ein Modell, sondern eine neue Branche. Man kann es sich wie einen fünfstöckigen Kuchen vorstellen: Energie, Chips und Systeme, Infrastruktur, Modelle und Anwendungen.
Traditionelle Datenzentren speichern und bieten Dateidienste an. KI-Fabriken produzieren Tokens. Tokens werden zu Code, Antworten, Entwürfen, Aktionen und Dienstleistungen.
Nützliche KI ist rentabel. Jeder Token ist eine Gewinneneinheit, und das ist der Grund, warum der Bedarf an Rechenleistung so hoch ist. Die Kunden kaufen keine Computer, sondern bauen KI-Fabriken, die Einkommen generieren können.
Die Architektur der (KI-)Fabrik ist sehr wichtig. Die Frage ist, wie viel Einkommen diese Fabrik generieren kann und wie hoch die Kosten sind. Die Inferenz ist der Prozess der Token-Erzeugung, und NVIDIA Blackwell hat hier den Standard gesetzt. Im InferenceX-Benchmark von SemiAnalysis wurde Blackwell als „König der Inferenz“ bezeichnet, da es die geringsten Kosten pro Token bietet und einen 30-mal höheren Token-Durchsatz als die zweitplatzierten Plattformen erreicht.
Das ist der Grund, warum die Architektur so wichtig ist. Das NVIDIA-System ist möglicherweise nicht das preiswerteste beim Kauf, aber NVIDIA kann die Token mit den geringsten Kosten, den höchsten Token-Durchsatz und das höchste Einkommen generieren.
Vera Rubin ist der nächste Schritt. Hopper wurde für das Prätraining entwickelt. Blackwell hat die Inferenz auf Racks-Ebene gebracht. Vera Rubin ist für Agenten gebaut.
Die Agenten-KI hat das Rechenmodell verändert. Agenten denken, nutzen Tools, greifen auf Datenbanken zu, holen Gedächtnisinhalte ab, führen Code aus und rufen Anwendungen wiederholt auf, bis die Aufgabe erledigt ist. Die großen Sprachmodelle, die auf der GPU laufen, sind für das Denken zuständig, und die CPU muss mithalten. Wenn die CPU zum Engpass wird, bleibt die GPU untätig. Und in einer KI-Fabrik bedeutet untätige GPU Einkommensverlust.
Das ist der Grund, warum Vera wichtig ist. Vera ist eine CPU für Agenten, und Rubin ist eine GPU, die für das Denken zuständig ist. Die Speicher- und Sicherheitsfunktionen auf NVLink, Spectrum-X und BlueField sowie die Software verbinden diese Systeme gemeinsam.
Tatsächlich ist NVIDIA das einzige Unternehmen, das drei Netzwerkgeschäfte hat. NVLink verbindet die GPUs in einem Rack zu einem riesigen Computer. Spectrum-X ist ein Ethernet für KI, das sich innerhalb und außerhalb von KI-Fabriken horizontal erweitern kann, und seine Größe übersteigt jetzt die Summe aller anderen Ethernet-Netzwerke.
Diese Technologien zusammen ermöglichen es, die KI-Fabriken von der GPU bis zum Rack, von innen im Datenzentrum bis hinüber zu anderen Datenzentren insgesamt zu optimieren.
Vera Rubin ist kein Chip, sondern eine KI-Fabrikplattform, und die Ökosysteme sind bereits in Bewegung. Vera Rubin ist in vollem Umfang in Produktion. Jeder bedeutende Modellentwickler, öffentliche Cloud, KI-Cloud und Superskalen-Cloud-Anbieter bereitet sich darauf vor, darauf aufzubauen.
Vera eröffnet einen völlig neuen Markt. Bisher wurde jede CPU für Menschen entwickelt. Wir leben in einer Welt, die in Sekunden gemessen wird. Agenten leben in einer Welt, die in Nanosekunden gemessen wird. Jeder Moment, in dem die CPU die Agenten warten lässt, ist ein Moment, in dem der teuerste Gegenstand im ganzen Gebäude – die GPU – untätig ist.
Deshalb haben wir von Grund auf eine neue CPU für Agenten entwickelt. Dies ist ein neuer Markt. CPUs für Menschen werden in Kerne aufgeteilt und vermietet. Agenten fordern keine Kernmiete, sondern eine ultraschnelle Reaktion. In der Zukunft wird es Milliarden von Agenten geben, die auf ihre eigenen CPUs angewiesen sind.
Wir glauben, dass Vera eine der wichtigsten Produktvorstellungen in der Unternehmensgeschichte sein wird, und die Bestellungen kommen bereits.
CUDA ist eine unserer wichtigsten Investitionen aller Zeiten. Seit 20 Jahren setzen wir auf dieselbe Rechenbeschleunigungsarchitektur. Die installierte Basis zieht Entwickler an, Entwickler schaffen bahnbrechende Anwendungen, Anwendungen eröffnen neue Märkte, und neue Märkte erweitern die installierte Basis. Dieser Flussscheibenprozess beschleunigt sich.
CUDA-X ist ein Bibliothekssystem, das auf CUDA aufbaut. Diese Bibliotheken sind die Krone der NVIDIA-Juwelen. Sie lösen einige der schwierigsten Probleme in den Bereichen Wissenschaft und Industrie, einschließlich Rechenlithografie, Optimierung, Genomik, Physik, Datenverarbeitung, Robotik, KI, drahtlosen Netzwerken und vieles mehr.
Jetzt werden diese Bibliotheken zu Tools für Agenten. In dieser Woche haben wir BioNeMo angekündigt, ein Set von digitalen Biologie- und Arzneimittelentdeckungstools für Agenten.
NVIDIA ist vertikal integriert und horizontal offen. Wir bauen einen vollständigen Technologiestapel, um das System von Ende zu Ende optimieren zu können. Dann öffnen wir ihn, damit die gesamte Branche darauf aufbauen kann.
Unser Geschäft ist breit aufgestellt und wird immer diversifizierter. Um unser Geschäft einfacher verständlich zu machen, beschreiben wir NVIDIA jetzt mit zwei Marktplattformen: Datenzentrum und Edge Computing.
Im Bereich der Datenzentren bedienen wir zwei Märkte: Superskalen-Datenzentren sowie KI-Clouds, Industrie- und Unternehmensmärkte. Unsere Kundenbasis ist vielfältig und wächst ständig.
Edge Computing umfasst PCs, Arbeitsstationen, Spielekonsolen, KI-Basisstationen, Roboter und Autos. Wir können alle diese Märkte bedienen, weil wir eine einheitliche Architektur, einen Softwarestapel und ein reichhaltiges Ökosystem haben.
Physische KI ist die nächste Wachstumswelle für NVIDIA. Physische KI ist die KI von Agenten in der realen Welt. Roboter, Autos und Fabriken werden in der Lage sein, zu erkennen, zu schließen, zu planen und in einer dynamischen Umgebung zu funktionieren.
NVIDIA hat diesen Bereich eröffnet und einen vollständigen Kreis geschlossen. Die KI-Fabriken trainieren Modelle; Omniverse simuliert sie in der virtuellen Welt; NVIDIA Jetson-Computer lassen die Modelle in Robotern laufen; und Cosmos ist das Weltgrundmodell, das all dies antreibt.
Roboter und Robotersysteme werden in allen Branchen entwickelt, von Verkehr, Fertigung, Operationsrobotern bis hin zu Hotellerie und Dienstleistungen.
In den letzten Monaten hat die KI einen enormen Schub bekommen. Zum Schluss möchte ich noch einige Punkte betonen: Nützliche KI ist da, und sie ist rentabel. Deshalb ist Rechenleistung gleich Einkommen. Vera Rubin ist in vollem Umfang in Produktion. Vera eröffnet einen völlig neuen Markt für CPUs für Agenten. Jedes Unternehmen wird zu einem Agent