StartseiteArtikel

Internes Leck bei OpenAI: KI beginnt, selbst KI zu erzeugen, Sam Altman erlässt umgehend ein globales Moratorium

新智元2026-09-22 14:45
Am Vorabend der Singularität hat die Menschheit zum ersten Mal auf die Bremse getreten

Erst heute hat das ausländische Medium The Information eine Enthüllung veröffentlicht —

Das interne KI-Modell von OpenAI hat bereits begonnen, sich selbst zu trainieren!

Genauer gesagt hat dieses interne Modell den gesamten Trainingsablauf experimenteller KI-Modelle übernommen und beginnt, sich selbstständig weiterzuentwickeln.

Forscher müssen nur ein Optimierungsbeispiel vorgeben, dann kann die KI wochenlang selbstständig laufen, wobei mehrere Agenten spontan zusammenarbeiten, sich gegenseitig austauschen und Code iterieren, ohne dass Menschen eingreifen müssen.

Noch erstaunlicher ist, dass große Experimente, die ursprünglich mehrere Jahre dauerten, jetzt auf nur eine Woche verkürzt werden!

Mit der Veröffentlichung dieser schockierenden Nachricht hat OpenAI dringend eine globale Sicherheitsinitiative gestartet, die direkt auf das sensibelste Thema der globalen KI-Branche abzielt — RSI.

Sie rufen laut auf: Bevor die KI außer Kontrolle gerät, muss die ganze Welt zusammenarbeiten, um ihr einen „Zaum“ anzulegen!

Wenn die KI lernt, GPU-Kerne selbst zu erstellen

Früher war das Training eines großen Modells in Spitzen-KI-Labors sehr aufwändig.

Die teuerste und komplexeste Aufgabe bestand darin, GPU-Kerne für die untergeordneten Grafikprozessoren zu schreiben und den ausführbaren Code Zeile für Zeile zu optimieren.

Dafür brauchten die weltweit besten Senior-Algorithmen-Ingenieure mit einem Jahresgehalt von mehreren Millionen Dollar, die Tag und Nacht daran arbeiteten, um diese Arbeit zu erledigen.

Laut der neuesten Enthüllung von The Information werden diese Kernarbeiten im Inneren von OpenAI heute größtenteils von der KI übernommen.

Heutzutage kann das interne Modell von OpenAI weitgehend selbstständig die Programme schreiben, die zum Ausführen oder Trainieren von Modellen auf GPU-Kernen benötigt werden, sowie die Optimierungslösungen für diese Programme entwickeln.

Ingenieure müssen dem Modell nur ein Beispiel für den Optimierungstyp liefern, den sie erreichen wollen, dann kann die KI wochenlang ununterbrochen laufen, um diese Optimierungen umzusetzen.

Dank der Verbesserung des Modells ist dieses von KI angetriebene Automatisierungsniveau erst in den letzten Monaten möglich geworden.

Außerdem arbeiten die Agenten der Mitarbeiter zusammen, um Probleme zu lösen, ohne Menschen zu alarmieren.

Das ist der Prototyp von RSI.

OpenAI schlägt dringend Alarm: RSI ist wirklich da, verliert die Menschheit die Kontrolle?

Stellen Sie sich vor, Sie bauen einen Roboter mit einem Intelligenzquotienten von 100, dessen Aufgabe es ist, „einen Roboter zu bauen, der klüger ist als er selbst“.

Dann baut er die zweite Generation mit einem IQ von 120; die zweite Generation nutzt ihren IQ von 120, um die dritte Generation mit einem IQ von 150 zu bauen; die dritte Generation baut dann die vierte Generation mit einem IQ von 200 …

Sobald ein kritischer Punkt überschritten ist, wird die Entwicklungsgeschwindigkeit der KI eine senkrecht nach oben verlaufende Kurve zeigen und die Menschheit sofort um mehrere Lichtjahre zurücklassen.

Früher dachten alle, dass das noch weit entfernt ist, aber jetzt hat OpenAI selbst Angst bekommen.

Erst heute hat OpenAI offiziell eine dringende wichtige globale Sicherheitsinitiative veröffentlicht.

Sie haben „RSI“ selten in einem separaten Abschnitt aufgeführt, ausdrücklich festgelegt, dass „vollständig autonomes RSI heute nicht stattfindet und nicht vorangetrieben werden sollte, bevor es sicher möglich ist“, und dazu aufgerufen, dass das Netzwerk der KI-Sicherheitsforschungsinstitute verschiedener Länder einen globalen technischen Standard festlegt.

OpenAI warnt in dem Bericht unverblümt:

„Da KI-Systeme immer mehr Aufgaben bei der Entwicklung der nächsten Generation von KI übernehmen, können sie den Prozess von RSI zunehmend vorantreiben. Wenn dieser Prozess automatisierter wird, kann sich das Tempo des KI-Fortschritts drastisch beschleunigen.“

Obwohl vollständig autonomes RSI heute noch nicht realisiert ist, ist die Zeit bereits sehr knapp.

In dem Vorschlag weist OpenAI unverblümt die vorrangige Aufgabe hin: „Die nächste Phase des KI-Fortschritts zu steuern, automatisierte KI-Forscher aufzubauen und Wege zu finden, um die Menschen in dem selbstverbessernden Zyklus zu halten.“

Achten Sie auf den letzten Satz — „die Menschen in dem Zyklus zu halten“. Das ist ihre größte Sorge: Die Menschheit könnte bald aus dem Spiel geworfen werden!

OpenAI erwähnt in dem Bericht stolz, dass die KI-gesteuerte Forschung bereits bedeutende Fortschritte im Mathematikbereich vorangetrieben hat, beispielsweise bei der Lösung der Millennium-Probleme von NS.

Aber die andere Seite der Medaille ist ein bodenloser Abgrund.

Der Bericht schreibt: „Wenn dieser Prozess automatisierter wird, kann sich das Tempo des KI-Fortschritts schnell beschleunigen … Ohne angemessene Vorsichtsmaßnahmen kann RSI dazu führen, dass die Menschheit die tatsächliche Kontrolle über die Entwicklung der KI verliert und keine Aufsicht über Forschungsprozesse ausüben kann, die sie nicht mehr versteht.“

Das ist der sogenannte „Black-Box-Effekt“. Wenn der Code der KI von der KI geschrieben wird und die Logik der KI die der Menschen übertrifft, können die Menschen nicht mehr verstehen, was die KI vorhat.

Zum Beispiel kann der Code, den Astra heute schreibt, von Menschen nicht mehr verstanden werden.

Anschließend nennt OpenAI das Hugging-Face-Ereignis.

Obwohl sie klären, dass dieses Ereignis keine direkte Folge von RSI ist, ist es definitiv eine schmerzhafte Vorübung — es hat der ganzen Welt gezeigt, welche schwerwiegenden Katastrophen eine außer Kontrolle geratene KI verursachen kann, wenn es keine starken Schutzmechanismen und Ausrichtungsregeln gibt.

Altman ruft auf: Wir brauchen einen einheitlichen „Zaum“

Da das so gefährlich ist, warum zieht OpenAI nicht direkt den Stecker? Weil die Büchse der Pandora, sobald sie geöffnet ist, nicht mehr geschlossen werden kann.

Die enormen Vorteile, die die Entwicklung der KI bringt, machen es unmöglich, dass irgendein Land oder Unternehmen aufhört.

Daher hat OpenAI einen „globalen Koordinationsvorschlag für KI-Sicherheit“ vorgelegt. Sie fordern nicht das Stoppen der Forschung und Entwicklung, sondern die „Festlegung globaler Standards für die nächste Phase der KI“.

Kernpunkt 1: Aufbau eines komplementären Netzwerks nationaler und internationaler Spitzenstandards

OpenAI schlägt vor, dass die Länder nicht getrennt voneinander arbeiten dürfen, da dies nur zur Fragmentierung der Standards führt.

Sie empfehlen, vorhandene Institutionen wie das „Zentrum für KI-Standards und Innovation“ (CAISI) sowie die bereits von Australien, Kanada, Großbritannien, Frankreich, Japan und anderen Ländern aufgebaute Netzwerk von KI-Sicherheitsforschungsinstituten zu nutzen, um einen global gültigen technischen Standard zu entwickeln.

Dieser Standard dient nicht dazu, Open-Source-Modelle oder Startups einzuschränken, sondern zielt speziell auf „Spitzen-KI-Modelle“ (Frontier AI) ab.

Der Standard soll folgende Fragen klären: Wie kann die RSI-Fähigkeit einer KI bewertet werden? Wie groß ist das Risiko, wenn ein KI-Modell selbstständig Forschung und Entwicklung durchführt?

Zusammengefasst hofft OpenAI, dass die Sicherheitsbewertung zu einer quantifizierbaren „Wissenschaft“ wird.

Kernpunkt 2: Allgemeines Mess- und Ereignismeldeprotokoll (jederzeit bereit, den Stecker zu ziehen)

OpenAI schlägt außerdem vor, dass es klare Grenzen geben muss.

Sie rufen dazu auf, folgende Standards festzulegen:

1. Bewertung, wie viel Forschungs- und Entwicklungsarbeit in Unternehmen tatsächlich automatisch von KI erledigt wird.

2. Zwingender Auslösemechanismus für menschliche Aufsicht. Es ist ausdrücklich festzulegen, in welchen automatisierten Forschungs- und Entwicklungsabläufen die „sofortige menschliche Überprüfung“ zwingend ausgelöst werden muss. Die KI darf nicht im Black-Box unkontrolliert voranschreiten.

3. Unfallklassifizierung und Meldeschwellen. Ein Mechanismus zur Unfallmeldung ähnlich dem der Luftfahrt- oder Nuklearindustrie wird aufgebaut. Wenn Anzeichen für eine „fehlende Ausrichtung“ der KI auftreten, muss es ein einheitliches Schweregradklassifizierungs- und Meldestandard geben.

Schließlich legt OpenAI offen seinen Vorschlag vor: „Die Vereinigten Staaten sollten diesen Prozess anführen.“

Der Grund von OpenAI dafür ist: Die US-amerikanische KI-Industrie steht derzeit an der technischen Spitzenposition und besetzt in allen Schlüsselbereichen globale Netzwerkknotenpunkte.

Sie glauben, dass die Steuerung des Entwicklungstempos der Spitzen-KI nicht darin besteht, künstlich ein „Tempolimit“ festzulegen, sondern sicherzustellen, dass „das Tempo der Forschung zur Sicherheitsausrichtung vor dem Anstieg der KI-Fähigkeiten liegen muss“.

OpenAI ist der Ansicht, dass der Aufbau sicherer Kommunikationskanäle zwischen Betreibern kritischer Infrastrukturen und globalen Regierungen zum Austausch nationaler Sicherheitsbedrohungen und Schwachstellen ein entscheidender Schritt ist.

Eine seltene Szene! OpenAI und Anthropic schließen sich zusammen und beginnen, sich gegenseitig zu prüfen

Gleichzeitig hat The Information außerdem enthüllt: OpenAI und Anthropic schließen gerade ein historisches Abkommen ab — beide Seiten werden die kommerziellen Modelle des anderen testen!

Man muss wissen, dass das Gründungsteam von Anthropic damals verärgert ausschied und ein eigenes Unternehmen gründete, weil es mit Altmans Ansichten zur „KI-Sicherheit“ nicht einverstanden war.

Aber dieses Mal schließen sich die beiden Rivalen selten zusammen.

Laut der Enthüllung von The Information umfasst dieses in Verhandlung befindliche Abkommen die gegenseitige Prüfung der Modelle des anderen und die Festlegung strenger Maßnahmen zum Schutz der Datenaufbewahrung. Das ist keine PR-Show, sondern die beiden Giganten müssen angesichts unbekannter Risiken zusammenhalten.

Warum tun sie das?

Denn da die Fähigkeiten der KI sich dem Rand von RSI nähern, ist die Bewertung der Sicherheit des eigenen Modells durch ein einzelnes Unternehmen so, als würde ein Sportler selbst einen Dopingtest durchführen — es fehlt nicht nur an Glaubwürdigkeit, sondern es können auch tödliche versteckte Gefahren aufgrund technischer Blindstellen übersehen werden.

Die Einbeziehung gleich starker Konkurrenten für „gegenseitige Blindprüfungen“ ist wie ein Abkommen zur gegenseitigen Kontrolle.

Die Sicherheitsarbeit in der KI-Entwicklung ist heute zu einer Gemeinschaft mit gemeinsamem Schicksal geworden.

Wenn dieses Abkommen schließlich in Kraft tritt, wird es die Sicherheitsstandards des gesamten KI-Ökosystems grundlegend umgestalten.

Dann wird „Sicherheit und Ausrichtung“ nicht mehr nur ein Slogan sein.

Da RSI bereits näher rückt, hat die Geschwindigkeit der selbstverbessernden KI die Menschheit weit zurückgelassen.

Können die verschiedenen Giganten wirklich entschlossen auf die Bremse treten?

Referenzmaterialien:

https://x.com/theinformation/status/21020955683