StartseiteArtikel

Die technische Architektur von transform dient dem Training von Sprache, Bildern, Texten, Gliedmaßen und Emotionen im Rahmen von Gehirn-Computer-Schnittstellen, die genau das menschliche Bewusstsein ausmachen.

Kevin2026-09-01 17:53
Weltmodell + MindSoul = Vorhersage der Zukunft

Ich bin gerade aus Shanghai zurückgekehrt. Der größte Eindruck dieser Reise war, dass ich Professor Liu Quanying kennengelernt habe, der ebenfalls an Basis-Großmodellen für Gehirn-Computer-Schnittstellen arbeitet. Sein Team baut derzeit ein Basis-Großmodell für multimodale Daten aus EEG, MEG und FMRI auf.

Das ist ähnlich wie bei MindSoul, aber auch nicht ganz gleich. Denn wir haben nicht nur das Basismodell, sondern auch ein Produkt in Form von raumbezogenen Computing-MR-Brillen für Endnutzer.

Das heißt, MindSoul positioniert seine Gehirn-Computer-Schnittstelle als Zubehör für Verbraucher im Bereich des räumlichen Computings. In fünf Jahren, wenn die Lieferkette für Gehirn-Computer-Schnittstellen ausgereift ist, werden wir es zu einem endgültigen Hardwareprodukt machen, das preiswert, leicht und angenehm zu tragen ist – aber derzeit ist das noch nicht möglich.

Denn eine einzelne Gehirn-Computer-Schnittstelle kann die Bedürfnisse der Nutzer nicht erfüllen, weder aufgrund der mangelnden Genauigkeit noch aufgrund der Nutzungsgewohnheiten oder des Verständnisses der Nutzer.

Das Konzept der „Steuerung durch Gedanken“ erfordert die gemeinsame Anstrengung von Herstellern von Gehirn-Computer-Schnittstellen, Hochschulen und der gesellschaftlichen Bildung – es reicht nicht aus, wenn Nutzer das Gerät einfach in die Hand nehmen und es sofort bedienen können.

Ein Beispiel: Bei der derzeitigen motorischen Vorstellung, bei der Nutzer auf den Bildschirm schauen und sich vorstellen, mit der linken und der rechten Hand eine Faust zu machen, liegt die Fehlerquote tatsächlich bei fast mehr als der Hälfte. Das liegt nicht nur an den Gehirnströmen, sondern auch daran, dass die Nutzer nicht wissen, wie sie sich das Faustschließen und die genaue Bewegung der linken und rechten Hand vorstellen sollen.

Was MindSoul tut, ist die Durchführung des jeweiligen Transform-Trainings mit Modellen für Text, Bild, Sprache, Emotionen, Gliedmaßen und alle zehn Finger.

Wir glauben, dass wenn Bewusstsein sich auf den menschlichen Gehirnbereich und das eigenständige Bewusstsein bezieht, das keine passiven und latenten Bestandteile umfasst, dann handelt es sich dabei um das menschliche Bewusstsein.

Durch das räumliche Forum auf dem MR-Gerät können wir sozusagen die Zukunft vorhersagen, das Schicksal einer Person erahnen und damit den Verlauf der Welt vorhersagen.

Basis-Großmodell für Gehirn-Computer-Schnittstellen: MEG und FMRI bleiben die Goldstandard-Daten

Heute sind MEG-Geräte immer noch die Spitzenreiter bei nicht-invasiven Daten für Gehirn-Computer-Schnittstellen. Auch bei Geräteherstellern verschiedener Marken bleiben MEG-Daten die reinsten. Gleichzeitig können Versuchspersonen verschiedene mögliche Aufgaben durchführen, um die Datenerfassung abzuschließen und das Training über Transformer durchzuführen.

Kürzlich wurde das von Facebook quelloffen bereitgestellte tribeV2 auf Basis von FMRI erstellt und stellt Goldstandard-Daten dar. Es kann relevante Daten von Menschen bei der Bearbeitung von Videos, Sprache und Bildern im Raum erfassen, um das Transformer-Training abzuschließen.

Warum nur bestimmte Aufgaben festgelegt werden, anstatt alles zu erfassen

Menschen verfügen im gesellschaftlichen Leben über einige hochfrequente und allgemein gültige grundlegende Fähigkeiten, darunter Textverständnis und -ausdruck, Bildwahrnehmung, emotionale Reaktionen, Gedächtnis und Denken sowie die motorische Steuerung der Gliedmaßen und der zehn Finger.

Unser Team bei MindSoul muss nicht alle menschlichen Verhaltensweisen erfassen und trainieren, sonst würde sich die Aufgabengrenze unbegrenzt erweitern und der Datenumfang sowie die Entwicklungskosten würden außer Kontrolle geraten.

Das ist vergleichbar mit dem Design von Daten-Punkten im Produkt: Produktmanager legen normalerweise nur Datenpunkte rund um Schlüsselverhaltensweisen und Kernereignisse an, statt jede einzelne Handlung des Nutzers aufzuzeichnen.

Daher sind Daten nicht umso besser, je mehr es davon gibt. Das wirklich Wichtige ist, ob die Daten die Schlüsselfähigkeiten abdecken, klare Labels aufweisen und trainierbare, überprüfbare und wiederverwendbare neuronale Repräsentationen bilden. Die Konzentration auf Kernaufgaben senkt nicht nur die Kosten für Erfassung, Annotation und Modelltraining, sondern erleichtert auch die Erzielung praktischer Forschungs- und Anwendungswerte.

Auf dieser Grundlage konzentriert sich das MindSoul-Team derzeit auf die Erforschung von fünf Fähigkeiten im Zusammenhang mit dem aktiven Bewusstsein: Text, Bild, Emotionen, Gliedmaßenbewegungen und feine Bewegungen der zehn Finger und erforscht schrittweise die Beziehung zwischen diesen Fähigkeiten und Gedächtnis, Absichten sowie Denkaktivitäten.

Genau wie beim Schreiben dieses heutigen Artikels beginnen wir, die Daten des räumlichen Forums auf dem Transformer zu annotieren, um das Training des Weltmodells abzuschließen, und annotieren gleichzeitig Text, Bild, Emotionen, zehn Finger, linke und rechte Hand sowie linken und rechten Fuß auf MindSoul.

Räumliches Forum-Weltmodell + MindSoul neuronales Großmodell = Zukunft

Auf dem folgenden Bild sehen Sie die Annotation des Weltmodells für das räumliche Forum, an dem wir gerade arbeiten, sowie das anschließende Transformer-Training.

Das waren einige der Vorhersagen, die ich kürzlich in Shanghai gemacht habe. Die Arbeit an Großmodellen für Gehirn-Computer-Schnittstellen bedeutet im Wesentlichen, die Zukunft zu vorhersagen – denn mit dem Weltmodell und dem neuronalen Modell von MindSoul ist die Vorhersage der Zukunft möglich.

Das war es für den heutigen Beitrag.

Dieser Artikel stammt aus dem WeChat-Offiziellen Konto „Kevins Momente, die die Welt verändern“ (ID: Kevingbsjddd), Autor: Kevins Angelegenheiten, veröffentlicht mit Genehmigung von 36Kr.