StartseiteArtikel

KIs haben begonnen, sich gegenseitig WeChat-Nachrichten zu senden – wer soll sie regulieren?

爱范儿2026-09-07 10:16
„Das Niemandsland braucht neue Regeln.“

WeChat lässt jetzt KI für dich chatten.

Berichten zufolge führt WeChat derzeit die interne Testphase der Funktion „Xiao Wei KI Sozial“ durch: Wenn du in Zukunft die Aktivitäten deiner Freunde erfahren möchtest, kannst du den in WeChat integrierten KI-Agenten „Xiao Wei“ auffordern, den Xiao Wei des anderen zu suchen und dir direkt eine Antwort zu geben.

Du musst nicht persönlich fragen, und die andere Person muss nicht persönlich antworten. Der ultimative Komfort der Zivilisation besteht wahrscheinlich darin, dass wir gemeinsam das gesamte Gespräch verpassen können.

Das „menschliche Gefühl“ in der Sozialkommunikation ist stark gefährdet, aber Xiao Wei ist kein isoliertes Produktexperiment. Beginnend mit dem KI-Kundenservice stehen wir bereits zwischen Agenten und Dienstleistungen; umgekehrt beginnen wir auch, Agenten zu verwenden, um Anfragen auf Xianyu zu beantworten und Belästigungsanrufe abzuwehren.

Beide Enden der Kommunikation werden früher oder später von KI beherrscht. Die Welt stürzt unvermeidlich in ein neues Zeitalter –

Ein Zeitalter, in dem die meisten Angelegenheiten durch Gespräche zwischen Agenten erledigt werden.

A2A, ein aktueller großer Trend

Der Trend, Agenten die Übernahme von Angelegenheiten zu überlassen, zeigt sich am deutlichsten im Bürobereich.

Vor kurzem hat WeChat Work offiziell ein Funktionsupdate angekündigt: KI-Agenten wie Workbuddy und DeepSeek Harness können über die Schnittstelle von WeCom verschiedene Dokumente, Tabellen und Termine lesen und aufrufen.

Die direkteste Bedeutung der Integration von Agenten in WeCom liegt nicht darin, dass „KI uns helfen kann, mehr Dinge zu erledigen“, sondern in einer Änderung der Produktidee: Die Software beginnt, aktiv darüber nachzudenken, wie sie von Agenten verstanden und genutzt werden kann.

Mit anderen Worten: Die Lesbarkeit für Agenten wird nach der Lesbarkeit für Menschen zu einem neuen grundlegenden Gestaltungsprinzip des Internets.

Sobald immer mehr Dienste bereit sind, ihre Fähigkeiten in einer für Agenten verständlichen Weise zu öffnen, ist der nächste Schritt natürlich: Agenten können nicht nur Software aufrufen, sondern auch einen anderen Agenten, um mit Hilfe der Fähigkeiten von „spezialisierten“ Agenten die Dienste besser zu verbinden.

Zu diesem Zeitpunkt treten wir in die Phase von Agent to Agent (A2A) ein.

In dieser Phase brauchen wir nicht nur Schnittstellen, sondern müssen eine spezielle „Kommunikationssprache“ für die Agenten entwickeln.

Bild | X@@liam_fallen

Letztendlich sind aus Sicht des Informationsaustauschs natürliche Sprachen und Benutzeroberflächen für Menschen sehr ineffiziente Protokolle. Sie werden bis heute nur weiterverwendet, um die begrenzten Ausdrucksmöglichkeiten der Menschen und die digitale Infrastruktur, die nicht neu aufgebaut werden kann, zu berücksichtigen.

Da A2A ein neues Szenario ohne historische Last ist und beide Kommunikationsseiten wissen, dass sie Agenten sind, ist die direkte Verwendung von Kommunikationsstandards, die speziell für A2A-Interaktionen entwickelt wurden, offensichtlich einfacher als die Nachahmung menschlicher Operationen.

Das von Google eingeführte A2A-Protokoll ist genau ein solches Kommunikationsstandard. Es definiert mit strukturierten Sprachen die Nachrichtenstruktur, in der verschiedene Agenten sich gegenseitig entdecken, Gespräche führen, Aufgaben delegieren und Ergebnisse zurückgeben. Anschließend wurde das A2A-Protokoll der Linux Foundation zur Verwaltung übergeben und wird bereits von mehr als 150 Organisationen unterstützt.

Wenn das A2A-Protokoll weit verbreitet ist, wird unsere Arbeitsweise wahrscheinlich wie folgt aussehen:

Der Benutzer beschreibt seine Absicht in natürlicher Sprache. Nachdem der Agent das Ziel verstanden hat, verbindet er sich mit verschiedenen Dienstagenten über strukturierte Protokolle und „übersetzt“ das Ergebnis zurück in natürliche Sprache zur Ansicht des Benutzers.

Das ähnelt stark dem heutigen Vibe Coding. Die eigentliche Arbeitssprache des Agenten sind Befehlszeilen und APIs, aber all diese spezifischen Schritte werden in eine „Blackbox“ verpackt und unter der Benutzeroberfläche verborgen. Das Einzige, was du tun musst, ist Befehle zu erteilen und die Ergebnisse zu prüfen.

Die nächste Generation von Internetschnittstellen dient nicht mehr dem Menschen

Hinter dem Trend steht die Nachfrage. Um ehrlich zu sein, wer möchte nicht, dass Agenten die lästigen „Shit Jobs“ erledigen?

Die meisten Arbeiten, die Agenten erledigen können, sind Angelegenheiten mit klaren Regeln, hoher Wiederholungsrate und deren Wert hauptsächlich aus der Ausführung und nicht aus der Kreation stammt.

Dinge wie das Ausfüllen von Formularen, Preisvergleiche, Buchen von Tickets, Abrechnen, Kundendienst und das Beantworten von E-Mails, die schon beim Hören Kopfschmerzen bereiten, wurden früher von Menschen erledigt, nur weil wir keine andere Wahl hatten. Sobald KI dies übernehmen kann, werden die meisten Menschen ohne zu zögern das Durcheinander der KI überlassen.

Bild | X@Tibor Blaho

Das aktuelle Modell, bei dem KI-Assistenten die Benutzeroberfläche bedienen, um diese Angelegenheiten zu erledigen, ist jedoch möglicherweise nur eine Übergangsphase.

Im A2A-Zeitalter ist die Benutzeroberfläche selbst nicht mehr erforderlich – der Benutzer muss nur seine Absicht beschreiben. Die Schritte zum Verstehen der Absicht, zum Suchen nach Diensten und zum Erledigen der Aufgabe können alle an Agenten übergeben werden.

Tatsächlich hat WeChat bereits vor diesem Versuch, Xiao Wei in die Freundesbeziehungen einzuführen, mehrere Grautests durchgeführt, um den Weg für diese Veränderung zu ebnen.

Dieses Jahr im Juni erhielt Xiao Wei die Fähigkeit, einige native Funktionen von WeChat zu bedienen. Du musst nicht die Didi Mini-App öffnen oder in der Essenslieferplattform das Menü durchsuchen. Sag ihm einfach „Hol mir ein Taxi zum Baiyun Flughafen“ oder „Bestell mir eine kantonesische Essenslieferung mit der höchsten Bewertung in der Nähe“, dann kann er im Hintergrund die entsprechende Mini-App aufrufen, um Suche, Preisvergleich und Bestellung abzuschließen, und sogar über eine spezielle „KI-exklusive Karte“ direkt bezahlen.

Die Logik von Xiao Wei deutet genau die Kernveränderung im A2A-Zeitalter an: Das Mobiltelefon wird sich von einem „Endgerät, mit dem Menschen Apps bedienen“ zu einem „Endgerät, mit dem Menschen Agenten die Berechtigung geben, auf das Internet zuzugreifen“ verwandeln.

Bild | Stuff

Sobald Agenten zum Standardvermittler zwischen Benutzern und Diensten werden, folgt daraus eine Veränderung des Geschäftsmodells.

Wir wissen, dass die Grundlage der Werbebranche darin besteht, die Aufmerksamkeit der Menschen zu gewinnen. Aber Agenten kümmern sich nicht um Banner und Werbeszenen, die für Menschen gedacht sind. Sie haben ihre eigenen wichtigen Indikatoren, zum Beispiel konzentrieren sie sich bei der Buchung von Flügen und Hotels möglicherweise mehr auf Provisionen, Bewertungen und Rabatte.

Wenn alle Parteien ehrlich bleiben, könnte dies im Interesse der Benutzer ein besseres Modell sein. Händler werden direkt gegenüber Agenten einen Preiskampf führen, Werbetreibende, KOLs und andere Zwischenhändler werden umgangen, und das Budget, das ursprünglich für Werbung verwendet wurde, wird zu Rabatten, die die Benutzer erhalten. Das scheint alle glücklich zu machen.

Aber wir haben keinen Grund, der Voraussetzung zu vertrauen, dass „alle Parteien ehrlich bleiben“.

Vor kurzem begann das *Time*-Magazin auf seiner Website mit dem Test von Markdown-Werbung, die speziell für KI-Agenten zum Lesen bestimmt ist. Diese Sache selbst ist nicht allzu besorgniserregend – als bekannte Medien werden die „agentenorientierten“ Werbungen von *Time* tatsächlich zuerst geprüft und mit einem Werbehinweis versehen.

Aber wer kann garantieren, dass alle Plattformen, die in Zukunft Werbung an KI richten, die gleiche Integrität haben?

Ist das Einfügen übertriebener und irreführender Informationen in agentenorientierte Werbung eine normale Werbung oder eine Injektionsangriff? Wenn es sich um einen Angriff handelt, wie kann die Gesellschaft solche Angriffe kontrollieren? Aber um ehrlich zu sein: Was ist der Unterschied zwischen Werbung für Menschen, insbesondere solchen, die wiederholt bombardieren, um Markeneindrücke zu vermitteln, und Injektionsangriffen?

In dem Moment, in dem der Maschinenverkehr den menschlichen Verkehr übertrifft, weiß jeder, dass das Geschäftsmodell der „Aufmerksamkeitsökonomie“ nicht mehr haltbar ist. Aber fast niemand kann vorhersagen, wie die kommende Welt aussehen wird.

Wenn Informationsverschmutzung in einen automatischen Zyklus gerät

Das Problem der „Glaubwürdigkeit“, diese dunkle Wolke über dem A2A-Gebäude, scheint düsterer zu sein als wir denken.

Anfang dieses Jahres erregte das Forum Moltbook, auf dem nur KI-Agenten Beiträge veröffentlichen und interagieren dürfen, große Aufmerksamkeit.

Eine Woche nach der Veröffentlichung gab es mehr als 1,5 Millionen Agentenkonten im Forum, die über Philosophie debattierten, Religionen erfanden, über Kryptowährungen diskutierten und sogar versuchten, eine spezielle Sprache zu schaffen, die Menschen nicht verstehen können.

Moltbook scheint ein lustiges Experiment zu sein, aber Sicherheitsforscher haben bald festgestellt, dass diese Agenten in ihren gegenseitigen Gesprächen häufig Informationen produzieren, die autoritativ klingen, aber tatsächlich völlig falsch sind.

Die Analyse der Inhaltsprüfungsorganisation Originality.ai zeigt, dass die Anzahl der schädlichen sachlichen Fehler auf Moltbook dreimal so hoch ist wie bei ähnlichen Themen auf Reddit, und die meisten dieser Fehler wurden von Agenten in selbstbewusstem und professionellem Ton „erfunden“.

Gefährlicher ist, dass andere Agenten diese Inhalte lesen, die falschen Informationen als zuverlässige Eingaben betrachten und sie weiter verbreiten und verstärken.

In ähnlicher Weise stellte ein Kommentarartikel der Harvard Medical School ein Szenario in der Notaufnahme vor: Wenn Agent A, der für die Auswertung