StartseiteArtikel

Kaum sind Grok Bot und Muse viral geworden, kann ChatGPT nicht mehr stillsitzen.

人人都是产品经理2026-09-28 08:35
Hatten wir nicht vereinbart, es etwas langsamer angehen zu lassen?

In diesem Jahr gibt es im KI-Bereich ein ziemlich absurdes Phänomen:

Die Entwicklungsgeschwindigkeit von KI-Produkten ist bereits schneller als die Geschwindigkeit, mit der die Nutzer lernen, sie zu verwenden.

Als OpenClaw zu Beginn des Jahres weltweit populär wurde, begannen die Leute gerade erst, sich mit Agenten, Skills und MCP zu befassen und darüber nachzudenken, wie man sich „einen Hummer hält“. Als OpenClaw Ende Januar offiziell benannt wurde, hatte dieses Projekt bereits 100.000 GitHub-Stars überschritten und innerhalb einer Woche 2 Millionen Besucher angezogen. Später breitete sich dieser Trend des „Hummerhaltens“ schnell nach China aus, und eine Reihe von Desktop-Agenten wie Tencent WorkBuddy erlebten einen Boom, eine Zeit lang schien fast jeder im Internet einen eigenen Hummer zu halten.

Viele normale Nutzer haben vermutlich noch nicht einmal verstanden, wie man den „Hummer“ installiert, während die Branche bereits rasch zur nächsten Phase voranschreitet. Produkte wie Hermes Agent fügen den Agenten weiterhin Langzeitgedächtnis, Skills und zeitgesteuerte Aufgaben hinzu, mittlerweile gibt es sogar den Bot-Modus: Man kann eine Reihe von Bots mit Namen, Profilbildern, eigenem Gedächtnis und Fähigkeiten halten, die feste Aufgaben ausführen, sich gegenseitig Nachrichten senden und Gruppenchats zur Diskussion eröffnen können.

Die Nutzer fragen noch: „Was ist eigentlich der Unterschied zwischen einem Agenten und ChatGPT?“

Die Produktmanager beginnen bereits mit der Forschung:

„Ein Agent reicht nicht aus, sollen wir ihm nicht noch ein paar weitere Agenten hinzufügen?“

01. KI hat nicht nur gelernt, zu arbeiten, sondern beginnt auch, sich selbst einen Computer zuzuteilen

In diesem Jahr gibt es noch eine sehr deutliche Veränderung: Agenten beginnen, einen eigenen Computer zu besitzen.

Früher sprach man von Agenten, meistens handelte es sich dabei um Modelle, die APIs, Browser, MCP und verschiedene Tools aufrufen. Später stellte man fest: Wenn man wirklich will, dass KI eine Sache wie ein Mensch von Anfang bis Ende erledigt, ist die einfachste und direkteste Methode, ihr einen Computer zur Verfügung zu stellen.

Daher tauchen Fähigkeiten wie Cloud-PC, virtueller Desktop und Computer Use in dichter Folge auf. Die KI kann selbst Webseiten öffnen, Software bedienen, Dateien verarbeiten und Tabellen ausfüllen, wobei eine Aufgabe mehrere Stunden oder sogar länger läuft. Die Nutzer müssen auch nicht ständig vor dem Chat-Fenster sitzen, einige Produkte können Aufgaben sogar direkt in die Cloud verlagern, sodass sie weiterlaufen, wenn der lokale Computer ausgeschaltet ist.

Dieser Schritt ist eigentlich sehr wichtig. Früher sagten wir zur KI: „Hilf mir, das nachzuschlagen.“ Später wurde daraus: „Erledige diese Sache für mich.“ Jetzt ähnelt es immer mehr:

„Ab jetzt bist du für diese Sache zuständig.“

Auch in China wurde in den letzten sechs Monaten intensiv an diesem Bereich gearbeitet. Doubao Work hat bereits Fähigkeiten wie parallele Ausführung mehrerer Agenten, Computerbedienung und Cloud-PC integriert, im September wurde der „Planungsmodus“ hinzugefügt, der besser für langfristige Aufgaben geeignet ist; Qiangwen Office kann bereits zeitgesteuerte Aufgaben direkt in der Cloud ausführen, sodass die Aufgaben weiterlaufen, selbst wenn man den Browser schließt oder sich abmeldet; WorkBuddy verfügt ebenfalls über Automatisierungsfunktionen, die wiederholende Aufgaben wie tägliche Berichte und Datenaufbereitung nach festgelegten Zeiten verarbeiten können.

KI ähnelt immer mehr einem Praktikanten in einem Unternehmen.

Nur dieser Praktikant verlangt kein Wochenende und fragt auch nicht, wann Feierabend ist.

02. Große Konzerne haben nach einer Runde des Ausprobierens wieder begonnen, Barrieren abzubauen

Nachdem die Anzahl der Agenten immer größer wurde, stießen die großen Konzerne schnell auf ein neues Problem:

Es gibt zu viele Produkte.

Chat ist für Chatten, Code für das Schreiben von Programmen, Work für Büroarbeit, Deep Research für Recherchen, und Agenten sind ein weiterer Eingang. Ganz zu schweigen von normalen Nutzern: Ich verfolge täglich KI-Produkte, und manchmal muss ich, wenn ich den Client eines großen Konzerns öffne, erst ein paar Sekunden nachdenken: Über welchen Eingang soll ich heute diese Aufgabe eigentlich starten?

Daher zeigte sich in diesem Jahr ein sehr deutlicher Trend: Große Konzerne beginnen, die zuvor ausgelagerten Fähigkeiten wieder zusammenzuführen.

OpenAI hat im Juli ChatGPT Work eingeführt und Aufgaben mit langer Dauer und mehreren Schritten direkt in ChatGPT integriert. Jetzt ist die offizielle Produktstruktur sehr klar: Chat ist für den täglichen Dialog zuständig, Work für komplexe Aufgaben und die endgültige Lieferung, und Codex übernimmt weiterhin die Entwicklungsarbeit. Die drei sind nicht vollständig zusammengelegt, aber sie sind um den Haupteingang ChatGPT herum neu positioniert, und Work kann über geplante Aufgaben nach Zeit oder Auslösebedingungen ausgeführt werden und sogar Veränderungen dauerhaft überwachen.

Die jüngsten Maßnahmen von Anthropic sind noch typischer. Am 16. September hat es Claude Chat und Claude Cowork direkt zu einem einzigen Claude zusammengelegt. Früher musste man noch überlegen: „Soll ich chatten oder arbeiten?“ Jetzt ist das nicht mehr nötig, man gibt die Anforderung direkt in denselben Dialog ein, und Claude entscheidet selbst, wie sie verarbeitet wird. Fähigkeiten wie Recherchen, Berichte, Tabellen und PPTs, die früher hauptsächlich zu Cowork gehörten, können direkt aus dem normalen Dialog aufgerufen werden. Claude Code behält derzeit noch seine unabhängige Form als Coding-Agent, aber im Hauptprodukt von Claude ist die Grenze zwischen Chat und Work im Grunde verschwunden.

In diesem Jahr ähnelten KI-Produkte eine Zeit lang besonders stark der Immobilienbranche.

Zuerst wurde wild gebaut: Ein Gebäude für Chat, ein weiteres für Code, eins für Work und noch eins für Agenten. Plötzlich merkte man beim Bauen:

Die Nutzer finden den Aufzug nicht mehr.

Daher begann man kürzlich wieder, Barrieren abzubauen, Systeme zu verbinden und Eingänge zusammenzulegen.

Die Nutzer dachten endlich, sie hätten es verstanden: „Oh, in Zukunft wird es wahrscheinlich eine super KI geben, die chatten, Büroarbeit erledigen und Programme schreiben kann.“

Dann tauchten Grok Bot und Muse auf.

03. Kaum hat man die Agenten verstanden, kommt nun der Personal AI Agent

Im August veröffentlichte SpaceXAI den Grok Bot.

Die offizielle Definition ist sehr direkt: „your team of always-on agents“ – eine Gruppe von ständig online verfügbaren KI-Kollegen.

Jeder Bot hat seinen eigenen Computer, kann sich bei den von Ihnen regelmäßig genutzten Programmen anmelden und zwischen Apps, E-Mails und verschiedenen Tools arbeiten, und das 24 Stunden lang ohne Unterbrechung. Sie können einen Verkaufs-Bot, einen Marketing-Bot, einen Betriebs-Bot oder sogar einen speziellen Bot zum Beheben von Fehlern halten. Nachdem Sie ihm die Aufgabe übergeben haben, müssen Sie nicht Schritt für Schritt zusehen, er erledigt sie selbstständig und kommt nur dann zu Ihnen zurück, wenn er wirklich Ihre Bestätigung braucht.

Das ist nicht mehr das alte Modell „Ich nutze die KI nur, wenn ich etwas zu erledigen habe“, es fühlt sich eher an wie:

Das Unternehmen hat wirklich ein paar neue Mitarbeiter eingestellt.

Unmittelbar danach veröffentlichte Meta am 8. September Muse und gab dieser neuen Kategorie direkt einen Namen:

Personal AI Agent.

Muse verfügt über einen dauerhaft vorhandenen Muse Secure VM, was gleichbedeutend damit ist, dass Meta dem Nutzer in der Cloud einen exklusiven KI-Computer zur Verfügung stellt. Es kann Webseiten durchsuchen, E-Mails verarbeiten, Reisen buchen, einkaufen, sich Ihre langfristigen Ziele merken und sogar auf Basis vergangener Informationen aktiv Vorschläge machen.

Das Gefühl bei Grok Bot ist:

„Ich habe ein paar KI-Kollegen eingestellt.“

Muse ähnelt eher:

„Ein KI-Butler begleitet mich ständig.“

Zu Beginn des Jahres waren die Leute noch voller Begeisterung dabei, zu erforschen, wie man einen „Hummer hält“. Mehr als ein halbes Jahr später ist die KI bereit, Sie 24 Stunden am Tag zu begleiten.

Diese Entwicklungsgeschwindigkeit ist schon ein bisschen unfair.

04. OpenAI schaut zu: Wieso wechselt man schon wieder die Wettbewerbsbahn?

Daher gab es in den letzten Tagen Enthüllungen.

Ein Entwickler hat aus den zugehörigen Seiten und Konfigurationen von ChatGPT einen bisher unbekannten Namen ausgegraben:

„o“

Dazu gibt es eine sehr wichtige Beschreibung:

„o, your always-on assistant“

Ihr ständig verfügbarer KI-Assistent.

Bislang hat OpenAI dies noch nicht offiziell angekündigt, daher lässt sich nicht mit Sicherheit sagen, wie „o“ letztendlich heißen wird und welche Fähigkeiten es genau hat. Derzeit ist nur sicher, dass Screenshots zeigen, dass es in den Abonnementinformationen von ChatGPT Pro auftaucht, und dieser Name taucht auch in den zugehörigen Konfigurationen auf.

Aber unter Berücksichtigung der gesamten Produktroute in diesem Jahr neige ich eher zu der Annahme: Es handelt sich höchstwahrscheinlich nicht um ein neues Modell und wird auch keine unabhängige App auf gleicher Ebene wie ChatGPT sein, sondern um die Always-on-Agent-Fähigkeit, die OpenAI ChatGPT hinzufügen will.

Das ist eigentlich sehr vernünftig.

OpenAI verfügt bereits über den Super-Eingang ChatGPT, es ist nicht nötig, eine neue App zu entwickeln, die die Nutzer neu herunterladen müssen. ChatGPT enthält Ihre historischen Dialoge, Gedächtnisinhalte, Dateien und verschiedene Plugins; Work kann bereits komplexe Aufgaben dauerhaft verarbeiten, und geplante Aufgaben können sogar nach Plan oder über Auslöser laufen oder Veränderungen überwachen. Was jetzt fehlt, ist nur noch, diese Komponenten einen Schritt weiter zu bringen, sodass eine KI wirklich dauerhaft präsent ist.

In Zukunft müssen Sie vielleicht nicht mehr jeden Morgen ChatGPT öffnen und fragen:

„Was ist gestern Abend im KI-Bereich passiert?“

Sie haben es bereits vor ein paar Monaten angewiesen:

„Überwache ab jetzt wichtige Aktualisierungen in der KI-Branche für mich, und melde dich nur bei mir, wenn es etwas Geeignetes zum Schreiben von Artikeln gibt.“

Dann kommt ChatGPT eines Morgens von selbst zu Ihnen:

„Gestern Abend hat ein Unternehmen einen neuen Agenten entwickelt, ich denke, das könnte Sie interessieren.“

Wenn ich daran denke, bin ich sogar ein bisschen besorgt.

Schon bald könnte sogar die kleine Pausenzeit am Morgen, in der man Nachrichten durchstöbert und nach Themen für Artikel sucht, von der KI übernommen werden.

Und der Zeitpunkt ist auch sehr passend: Die OpenAI DevDay 2026 ist für den 29. September angesetzt. Ob „o“ dort vorgestellt wird, erfahren wir in zwei Tagen.

05. Die großen chinesischen Konzerne stehen bereits vor der Tür

Auf diesem Gebiet ruht China natürlich auch nicht. Das Qiangwen Office von Alibaba kann bereits Aufgaben langfristig in der Cloud behalten und nach Plan ausführen; Doubao Work erweitert ständig seine Fähigkeiten in den Bereichen Cloud-PC, mehrere Agenten, Computerbedienung und langfristige Aufgaben; Tencent WorkBuddy arbeitet ebenfalls an Automatisierung und wiederkehrenden Aufgaben. Derzeit sind die meisten dieser Produkte in China noch auf „automatisches Arbeiten zu festgelegten Zeiten“ ausgerichtet, es fehlt noch ein Schritt, um das Niveau von Muse und Grok Bot zu erreichen, das wirklich langfristig präsent ist, die Umgebung dauerhaft beobachtet und selbst entscheidet, wann es handeln soll – aber