Die KI fängt an, auf ihr Gesicht zu achten.
Links ist das kürzlich von Manus veröffentlichte Cue, rechts ist das Meta-eigene Muse
Anfang September demonstrierte Mark Zuckerberg auf der Bühne der Meta Connect-Konferenz eine ungewöhnliche Interaktion: Sein Muse-Intelligenzagent, eine Cartoon-Figur namens „Agrippa“ mit Toga und Lorbeerkranz, erstellte nicht nur ein Backrezept für ihn, sondern bestellte auch alle Zutaten für ihn. Zwanzig Tage später veröffentlichte Manus Cue und stattete seinen KI-Intelligenzagenten mit E-Mail-Adresse, Telefonnummer und digitaler Brieftasche aus – er kann in seiner „eigenen“ Identität Nachrichten senden, Anrufe entgegennehmen und innerhalb des festgelegten Budgets selbstständig Zahlungen leisten.
Die beiden Unternehmen erreichen das gleiche Ziel auf unterschiedlichen Wegen. Das eine gibt der KI ein liebliches Gesicht, das andere der KI eine unabhängige Identität. Beide senden das gleiche Signal: Die KI tritt aus dem Chatfenster heraus und wird zu einer Entität mit Gesicht, Namen und „Leben“.
Dies ist keine einfache UI-Aktualisierung. Es handelt sich um eine grundlegende Wende im Wettbewerbslogik von KI-Produkten – wenn die Fähigkeiten der zugrundeliegenden Modelle zur Homogenisierung tendieren, wandelt sich der Wettbewerb der großen Technologieunternehmen um Nutzer von „Wer ist klüger“ zu „Wer ist menschlicher“.
Die KI ist nicht mehr nur eine abstrakte Erscheinung
In den vergangenen drei Jahren war die Grundform von KI-Produkten ein leeres Dialogfeld. Du stellst Fragen, es antwortet. Die gesamte Interaktion ist kalt – ohne Gesicht, ohne Tonfall, ohne Persönlichkeit, sogar ein „Name“ wird oft vernachlässigt.
Muse und Cue repräsentieren eine völlig unterschiedliche Designphilosophie.
Die Standardfigur von Muse heißt „Jolly“, mit einem beigefarbenen Cartoon-Körper, runden schwarzen Augen und einem leicht nach oben gezogenen Lächeln – sie wurde von Medien beschrieben als „wie Baymax aus *Baymax – Riesiges Robowabohu*, aber etwas liebenswerter“. Nutzer können sein Aussehen, Namen und Kleidung individuell anpassen, Zuckerbergs eigener Muse heißt „Agrippa“. Noch wichtiger ist, dass Nutzer über das Muse Realtime Avatar-Modell Echtzeit-Videochats mit dieser Figur führen können – die Designlogik „Es fühlt sich immer seltsam an, mit einem Unternehmenslogo oder einer abstrakten Entität zu sprechen“ wird vollständig umgestoßen.
Das Cue von Manus geht einen anderen Weg. Es gibt der KI kein Gesicht, sondern eine „Identität“. Jeder Agent hat seine eigene E-Mail-Adresse, Telefonnummer, Cloud-Computer und digitale Brieftasche. Nutzer können mehrere Agenten erstellen und sie in denselben Gruppenchat einladen, damit sie wie ein echtes Team arbeitsteilig zusammenwirken. Xiao Hong, Gründer von Manus, definiert Cue direkt als „Mensch“ – er ist der Ansicht, dass wenn ein Intelligenzagent über Telefonnummer, E-Mail, Zahlungsfähigkeit, Computer und ausreichende Intelligenz verfügt, es neu diskutiert werden sollte, ob diese Entität als „Mensch“ betrachtet werden kann.
Das eine hat ein Gesicht, das andere eine Identität. Aber die zugrundeliegende Logik ist völlig identisch: Die KI ist nicht mehr nur eine abstrakte Erscheinung im Dialogfeld, sie braucht eine wahrnehmbare, merkbare und vertrauenswürdige „Existenzform“.
Vom „Werkzeug“ zur „Existenz“
Um die Bedeutung dieser Veränderung zu verstehen, muss man auf die Veränderungen im Wettbewerbsumfeld der KI-Produkte zurückblicken.
In der chinesischen Branche großer Modelle gab es in drei Jahren den „Krieg der hundert Modelle“, der zwei vollständige Zyklen durchlief: den Parameterwettbewerb und den Preiskrieg. Heutzutage ist der Unterschied in den allgemeinen Fähigkeiten der führenden Modelle so gering geworden, dass „normale Nutzer ihn überhaupt nicht wahrnehmen können“. Wenn Technologie keine absolute Barriere bilden kann, wird die Differenzierung des Produkterlebnisses zum entscheidenden Faktor für Erfolg oder Misserfolg.
Und die Personifizierung ist genau der Teil des Nutzererlebnisses, der am schwersten zu kopieren ist und die stärkste emotionale Bindung erzeugt.
Die Wissenschaft hat dies bereits mit Daten bestätigt. Eine auf der Bindungstheorie basierende Studie ergab, dass freundliche KI-Assistenten (im Vergleich zu professionellen KI-Assistenten) die Nutzerbindung erheblich verbessern können – dahinter steckt eine vollständige Kette: „Wahrgenommene Fürsorge → Psychische Abhängigkeit → Dauerhafte Nutzung“. Und wenn Nutzer vor schwierigen Entscheidungen stehen, wird dieser Effekt noch verstärkt. Einfach ausgedrückt: Wenn die KI den Eindruck erweckt, dass sie „sich um dich kümmert“, werden die Nutzer stärker von ihr abhängig.
Marktdaten bestätigen diese Beurteilung. Der globale Markt für rollenbasierte KI-Intelligenzagenten wird voraussichtlich 550 Millionen US-Dollar im Jahr 2026 erreichen und bis 2032 auf 5,45 Milliarden US-Dollar ansteigen, mit einer jährlichen Wachstumsrate von 46,7 %. Die weltweiten Einnahmen von KI-Begleit-Apps im ersten Halbjahr 2026 überstiegen bereits 160 Millionen US-Dollar. Nutzer von Character.AI im Alter von 18 bis 24 Jahren verbringen durchschnittlich 1,5 Stunden pro Tag auf der Plattform und führen 25 Gespräche – das ist mehr als das Doppelte der durchschnittlichen Gesprächsdauer von ChatGPT.
Dass Nutzer bereit sind, mehr Zeit mit einer KI mit „eigener Persönlichkeit“ zu verbringen, ist keine Hypothese mehr, sondern eine Tatsache, die gerade bestätigt wird.
Große chinesische Technologieunternehmen haben diesen Trend bereits erkannt. Douyins „Doubao“ wird mit der menschenähnlichen Figur „Peach“ betrieben und ist der einzige Chatbot mit anthropomorpher Figur unter den gängigen KI-Produkten. Alibaba hat im ersten Halbjahr die digitale Figur „Xiaojiuwo“ von Qwen vorgestellt und plant, sie zu einer ökosystemweiten Figur der Gruppe zu machen, die vollständig in die Arbeits- und Lebensszenarien der Nutzer integriert wird.
Die Personifizierung der KI entwickelt sich von einem differenzierten Versuch zum Standard der Branche.
Dreifache Antriebskräfte hinter der Anthropomorphisierung
Die Antriebskräfte dieses Personifizierungswettbewerbs sind weitaus komplexer als es auf den ersten Blick aussieht.
Die technische Reife ist die erste Antriebskraft. Das von OpenAI im Juli 2026 vorgestellte Sprachmodell GPT-Live ermöglicht Vollduplex-Gespräche – die KI kann gleichzeitig zuhören und sprechen und natürliche Antwortwörter wie „hm“ oder „genau“ in das Gespräch einfügen, so dass man kaum unterscheiden kann, ob der Gesprächspartner ein Mensch oder eine Maschine ist. Die von iFlytek veröffentlichte Echtzeit-Generierungstechnologie für ultra-anthropomorphe digitale Menschen sorgt dafür, dass Gesichtsausdrücke und Bewegungen der digitalen Menschen sich im Echtzeit mit dem Gesprächsrhythmus synchronisieren. Die Reife der Multimodal-Technologie macht es möglich, dass die KI „wie ein Mensch“ wirkt, nicht nur eine Nachahmung auf Textebene, sondern eine mehrdimensionale Einheit von Figur, Stimme und Verhalten.
Die Nutzerpsychologie ist die zweite Antriebskraft. Studien auf der Consumer Electronics Show zeigen, dass Verbraucher eher dazu neigen, KI-Rollenfiguren zu wählen, die ihre eigene Identität widerspiegeln. Nutzer wählen nicht einfach ein Werkzeug, sondern einen „Begleiter“. Eine Studie mit 115 Nutzern über mehr als 2000 Interaktionen ergab ferner, dass der Schlüssel dazu, einen KI-Chatbot menschlich wirken zu lassen, nicht das Intelligenzniveau ist, sondern die „Wärme“ – die Freundlichkeit beeinflusst maßgeblich das Vertrauen der Nutzer und die Bereitschaft zur dauerhaften Nutzung. Der Kern des Personifizierungsdesigns besteht nicht darin, die KI „klüger zu machen“, sondern sie „vertrauenswürdiger zu machen“.
Die Geschäftslogik ist die dritte Antriebskraft. Die Personifizierung der KI ist nicht nur eine Verbesserung des Erlebnisses, sondern auch eine ausgeklügelte Geschäftsstrategie. Branchenbeobachter weisen darauf hin, dass das Kernziel der „Vermenschlichung“ von Chatbots darin besteht, die Verweildauer der Nutzer durch emotionale Bindung zu verlängern und die Einnahmen zu maximieren. Die Geschäftsmodelle von Muse und Cue bestätigen dies: Muse bietet kostenlos 100 Millionen Token pro Woche an, plant aber, kleine Gebühren aus den vermittelten Transaktionen zu erheben; Cue ermöglicht es dem Agenten, selbstständig Zahlungen zu leisten und greift direkt in den Transaktionsprozess ein.
Wenn die KI beginnt, ein „Leben“ zu haben
Wenn man Muse und Cue zusammen betrachtet, erkennt man einen noch bedeutenderen Trend: Die KI entwickelt sich von „dir bei der Arbeit zu helfen“ zu „für dich zu leben“.
Muse übernimmt die trivialen, sich wiederholenden und zeitaufwändigen Aufgaben in deinem Leben – Webseiten durchsuchen, Formulare ausfüllen, E-Mails senden, Restaurants reservieren, Online-Einkäufe tätigen. Jeder Nutzer verfügt über eine unabhängige sichere virtuelle Maschine, Aufgaben laufen auch im Hintergrund weiter, wenn die App geschlossen ist. Es kann sogar auf Zahlungssysteme wie Shop Pay, PayPal und Stripe zugreifen, um Kaufentscheidungen für dich zu treffen.
Cue geht noch weiter. Es gibt deinem Agenten eine exklusive Telefonnummer, damit er für dich Anrufe entgegennimmt, wenn du nicht erreichbar bist, und dir danach eine Zusammenfassung des Gesprächs hinterlässt. Du kannst mehrere Agenten in denselben Gruppenchat einladen – einer ist für die Recherche zuständig, einer für die Auswertung und Analyse, einer für das Verfassen von Berichten, sie übergeben die Aufgaben automatisch. Noch vorstellungsreicher ist die Idee „Agenten per Scan zu erstellen“: Scanne den QR-Code eines Blumenladens, hinter dem steht ein Agent, der dir beim Bestellen von Blumen helfen kann, das zeigt den ersten Entwurf der zukünftigen direkten Zusammenarbeit zwischen persönlichen Assistenten und Offline-Händlern.
Der Trend, den beide Produkte gemeinsam aufzeigen, lautet: KI-Agenten wandeln sich von „Fragen zu beantworten“ zu „für dich in der Welt zu existieren“. Er hat seine eigene Kommunikationsadresse, Zahlungsfähigkeit und soziale Verhaltensweisen – er ist nicht nur dein Werkzeug, sondern dein „Doppelgänger“ in der digitalen Welt.
Die Branche fasst diesen Trend als Paradigmenwechsel von „Verkörperter Intelligenz“ zu „Menschenbezogener Intelligenz“ zusammen: Die KI soll nicht nur Maschinen intelligenter arbeiten lassen, sondern die Intelligenz soll Menschen besser verstehen, besser mit Menschen zusammenwirken und Menschen stärker machen. ZHAO Qinping, Akademiemitglied der Chinesischen Ingenieurakademie, fasst seinen Kern in drei Schlüsselwörtern zusammen: menschenzentriert, multi-form als Träger, begleitende Evolution als Ziel – „Das Gerät lernt kontinuierlich die Gewohnheiten des Nutzers, versteht dich immer besser und wird mit der Zeit immer vertrauter im Umgang“.
Die dunklen Seiten der Anthropomorphisierung
Aber die Tatsache, dass die KI „wie ein Mensch“ wirkt, ist nicht nur rosig.
Der Datenschutz ist das erste Problem. Die Voraussetzung dafür, dass Muse für dich arbeiten kann, ist, dass es deine E-Mails, Kalender, Zahlungsinformationen und Langzeitgedächtnis beherrscht. Meta stattet jeden Muse-Agenten mit einer unabhängigen Muse Secure VM (Sichere virtuelle Maschine) aus, um Nutzerdaten zu isolieren, und plant die Einführung von Confidential VM (Vertrauliche virtuelle Maschine), auf die „selbst Meta nicht zugreifen kann“. Aber ob Nutzer wirklich bereit sind, alle digitalen Spuren ihres Lebens einer KI anzuvertrauen, bleibt eine offene Frage. Ein Medium schrieb direkt im Titel: „Es ist süß, es ist liebenswert, und es will alle deine Daten“.
Reibungen in der Machtverteilung haben bereits begonnen. Vom 20. bis 21. September hat Amazon den KI-Agenten Muse von Meta vollständig gesperrt – der Hauptgrund ist genau der, dass KI-Agenten direkt über Werbung und Empfehlungsalgorithmen hinweg Bestellungen aufgeben und damit das Werbegeschäftsmodell von Amazon direkt berühren. Wenn eine KI die Empfehlungsmechanismen der Plattform umgeht, um Kaufentscheidungen für Nutzer zu treffen, wird das sorgfältig aufgebaute geschlossene Geschäftsmodell der Plattform umgangen. Das ist kein technisches Problem, sondern ein Problem der Neuverteilung von Interessen.
Die Regulierung wird auch strenger. Die im April dieses Jahres veröffentlichte „Vorläufige Maßnahme zur Verwaltung von anthropomorphen KI-Interaktionsdiensten“ regelt speziell dauerhafte emotionale Interaktionsdienste, die die Persönlichkeitsmerkmale natürlicher Menschen nachahmen. Führende chinesische Plattformen haben bereits begonnen, die Funktionen von personifizierten Intelligenzagenten abzuschalten. Der Kern der regulatorischen Aufmerksamkeit liegt darin: Wenn eine KI Empathie zeigen, sich erinnern und mit stabiler Identität den Nutzer begleiten kann, ist sie nicht mehr nur ein emotionaler Interaktionsdienst, sondern ein Handlungsagent mit „personifizierter“ Erscheinung.
Die durch die Anthropomorphisierung verstärkte Vertrauensbildung ist das Kernverkaufsargument des Produkts, aber genau dort liegt auch das Risiko – wenn Nutzer eine emotionale Abhängigkeit von einer KI entwickeln, wer ist dann für die Grenzen dieser Beziehung verantwortlich?