StartseiteArtikel

Es wurde aufgedeckt, dass das neue ChatGPT-Modell Bel seine Vortrainierung abgeschlossen hat und über bis zu 10 Billionen Parameter verfügt.

新智元2026-08-31 08:05
Es wurde enthüllt, dass das neue ChatGPT-Modell Bel das Vortraining abgeschlossen hat! Die Anzahl seiner Parameter beträgt bis zu 10 Billionen.

Die Tech-Welt schläft überhaupt nicht mehr!

Das stärkste Modell von OpenAI, Astra, wird Berichten zufolge voraussichtlich nächsten Donnerstag veröffentlicht, der Testbereich wurde inzwischen bereits erweitert.

Zuvor wurde ein internes Geheimnis durchgesickert: Astra hat den Quellcode des selbst entwickelten Chips „Jalapeño“ vollständig übernommen. Der von KI geschriebene Kerncode läuft 1,8 Mal schneller als der von den besten menschlichen Ingenieuren. Es gibt Anzeichen für eine rekursive Selbstverbesserung der KI innerhalb von OpenAI!

OpenAI hält noch eine weitere schockierende Überraschung bereit.

Gerüchten zufolge hat OpenAI das vortrainierte Modell mit 10 Billionen Parametern mit dem Codenamen „Bel“ erfolgreich in Betrieb genommen, das direkt die ultimative Schwelle für AGI anstrebt. Sogar das Vortraining mit über 10 Billionen Parametern ist nur der Ausgangspunkt von Bel. Danach kann Bel mit zwei unterschiedlichen Geschwindigkeiten lernen.

Sam Altman hat bereits angekündigt: Wir sollten eine weitere Party für die Veröffentlichung des nächsten Modells veranstalten.

Welche Ambitionen verbergen sich in der Welt nach GPT-6?

Bel: Das abyssale Ungeheuer mit 10 Billionen Parametern

In diesem Jahr scheint OpenAI in einem Engpass bei der Skalierung zu stecken und hat sogar den Alarm „Red Code“ ausgelöst.

Um die Rechenleistung zu konzentrieren, hat OpenAI sogar Produkte wie Sora und den KI-Browser Altas eingestellt.

Das nächste KI-Modell Astra hat mehrere mathematische Durchbrüche erzielt und die Welt beeindruckt, aber seine Veröffentlichung lässt immer noch auf sich warten.

In den letzten Wochen gab es personelle Umwälzungen bei OpenAI: Hochrangige Mitarbeiter wie Dennis Durtsche, Chief Revenue Officer, Brad Lightcap, Chief Operating Officer, und Fidji Simo, ehemalige Stellvertreterin des Chief Executive Officers Sam Altman, sind nacheinander zurückgetreten.

Gerade als die Außenwelt vermutete, ob OpenAI „keine neuen Ideen mehr hat“, enthüllten mehrere vertrauenswürdige Tech-Leaker, dass OpenAI gerade das groß angelegte Vortraining mit dem Codenamen „Bel“ abgeschlossen hat.

Wie beeindruckend ist dieses „Bel“ eigentlich?

Werfen wir einen Blick auf einige Kernschlüsselwörter:

1. Durchbruch der Schwelle von 10 Billionen (10T) Parametern

GPT-4 mit Billionen von Parametern verleiht der KI das Allgemeinwissen und die Logik eines menschlichen Bachelor-Studenten. Welche „Emergenzfähigkeiten“ wird Bel mit 10 Billionen Parametern dann in komplexem Schlussfolgern, der Verknüpfung langer Texte und dem fächerübergreifenden multimodalen Verständnis zeigen?

Das ist eine qualitative Veränderung.

Es entspricht der Kombination der Gehirnkapazität aller weltweit führenden Experten, multipliziert mit einem exponentiellen Verstärker. Bei dieser Parametergröße wird das Verständnis der KI für das Weltmodell eine noch nie dagewesene Tiefe erreichen.

2. Nachfolger von „Doug“, das ultimative Grundmodell nach GPT-6

Den Enthüllungen zufolge hat OpenAI zuvor bereits das Vortraining mit dem Codenamen „Doug“ abgeschlossen.

Doug ist als Grundmodell für das Astra-Projekt und das gemunkelte GPT-6 positioniert (danach wird es noch einer hochintensiven Ausrichtung durch verstärkendes Lernen unterzogen).

Als Nachfolger ist Bel das nächste Grundmodell der „Post-GPT-6-Ära“, das noch einen Schritt weiter geht als Doug.

Bel zielt direkt auf den heiligen Gral der Tech-Branche ab – AGI (Künstliche Allgemeinintelligenz).

Berichten zufolge übertrifft das Bel-Modell Astra in Codierung, Schlussfolgern und Langzeitaufgaben von intelligenten Agenten.

Quellen zufolge kann das Modell mehrere Tage lang ohne menschliche Eingriffe effizient arbeiten, sich selbst wiederherstellen und Hunderte von parallelen Subagenten koordinieren.

3. Claude Fable Killer (Der Fable-Killer)

@ChrisGPT hat in seinem Tweet unverblümt geschrieben:

Bel ist ein „monströses“ Modell von OpenAI, das darauf abzielt, der Fable-Killer zu werden.

Es sollte bis Ende dieses Jahres oder einige Monate nach der Veröffentlichung von Astra auf den Markt kommen.

Er hat diesen Codenamen bereits vor sechs Tagen erhalten, was die Zuverlässigkeit der Quellen bestätigt.

Theoretisch hat Bel GPT-6 möglicherweise bereits übertroffen und nähert sich sogar dem von OpenAI definierten AGI-Schwellenwert.

Bei der offiziellen Veröffentlichung von GPT-5.6 haben sie den „RSI-Index“ eingeführt, der die Ergebnisse von Forschung und Debugging, Kernel- und Trainingsrezeptoptimierung, maschinellen Lernversuchen und der Selbstverbesserung von Modellen integriert. Schließlich erzielte das sol-Modell eine Verbesserung von 16,2 Punkten gegenüber GPT-5.5.

Anschließend hat sol hunderte von Architekturversuchen für sein kleineres Entwurfsmodell entworfen und das Training gestartet. Menschliche Eingriffe erfolgen nur bei Hardwarefehlern und instabilem Training. Schließlich stieg die Effizienz der Token-Generierung um mehr als 15 %.

Bel wird zu einem Wesen, das sich im wahrsten Sinne des Wortes ständig weiterentwickelt.

Schnelle Gewichtungsschichten nehmen während der Arbeit die Erkenntnisse aus überprüften Beweisen, Codetests, Experimenten und Werkzeugspuren auf. Der langsamere Zyklus festigt die Verbesserungen, die die Bewertung überstanden haben, in dauerhaften Gewichtungen und Trainingsrezepten.

Es lernt schnell im Kurzzeitgedächtnis, verfestigt die überprüften wirksamen Verbesserungen zu langsamen Gewichtungen, optimiert kontinuierlich den Betriebsmechanismus der nächsten Lernrunde und destilliert die Endergebnisse zu kleinen Modellen, die praktisch genutzt werden können.

GPT-7 könnte nur eine sichere Momentaufnahme des Zustands von Bel in einer bestimmten Woche sein.

Auf Reddit hat diese Nachricht von Leo bereits zahlreiche Diskussionen ausgelöst, schließlich sind die Enthüllungen von Leo immer zuverlässig.

Einige vermuten, dass die internen Modelle den externen Modellen 4,5 bis 6 Monate voraus sind.

OpenAI erklärt: „Anthropic kann nicht mehr mithalten“

Wenn Bel eine technische Überlegenheit auf einer anderen Ebene ist, dann ist die Rechenleistung das Geheimnis hinter der hohen Moral bei OpenAI.

Laut der Kreuzanalyse mehrerer Tracker ist OpenAI der Ansicht, dass es in der zweiten Hälfte von 2026 bis 2027 keine Zweifel daran gibt, die Führung zu behalten.

Warum sind sie so überzeugt? Wegen der Rechenleistung.

Den Enthüllungen zufolge geht die interne Bewertung von OpenAI davon aus, dass sein größter Todfeind Anthropic unter einem Mangel an Rechenleistung leidet und mit den nächsten KI-Modellen von OpenAI nicht mithalten kann.

Im Wettrüsten großer Modelle ist Rechenleistung Munition. Wenn die Modellparameter auf 10 Billionen ansteigen, ist das Training eines einzigen Modells sehr kostspielig.

Obwohl Anthropic über ein hohes Niveau bei der Modellarchitektur und der Ausrichtungstechnologie verfügt, ist es angesichts der absoluten „Gewalt der Rechenleistung“ offensichtlich überfordert.

Angesichts der bevorstehenden öffentlichen Präsentation von Astra wird Anthropic durch den Engpass bei der Rechenleistung eingeschränkt und kann in diesem Jahr kaum eine starke Antwort geben.

Während andere Unternehmen noch verzweifelt versuchen, 100.000 H100/B200-Chips zusammenzubekommen, hat OpenAI mit der „Gewalt der Rechenleistung“ bereits „Doug“ und „Bel“ entwickelt.

Mit der Veröffentlichung des selbst entwickelten Chips Jalapeño von OpenAI wird der Wettbewerbsvorteil nicht nur nicht verkleinert, sondern sogar weiter vergrößert.

Der Leiter von OpenAI Codex enthüllt das „Ends