Codex geht beispiellos vor und integriert GLM sowie Kimi, das Pro-Kontingent wird halbiert, GPT-6.1 Sol und der 24-Stunden-Agent werden erstmals online veröffentlicht.
Im Fort Mason-Veranstaltungsort am Ufer der San Francisco Bay hat Altman auf einen Schlag Dutzende von dichten Aktualisierungen vorgestellt.
Kurz vor der Eröffnung dieses DevDay war der Schatten des unkontrollierten Sicherheitsrisikos großer Modelle noch nicht verschwunden, die ursprünglich als Höhepunkt geplante Flaggschiff-Version GPT-6.1 Astra wurde jedoch wegen Bedenken hinsichtlich Ausrichtung und Täuschungsverhalten dringend zurückgezogen.
Doch dies hinderte Altman nicht daran, seine radikalen Produktambitionen zu zeigen, insbesondere auf dem Schlachtfeld des „Persönlichen Agenten (Personal Agent)“, das er unbedingt gewinnen will.
Von dem offiziellen Debüt von 24-Stunden-online verfügbaren digitalen Mitarbeitern namens dots, die von GPT-6 Astra angetrieben werden; der vollständigen Einführung von Space und Pages, die mit kollaborativer Bürosoftware konkurrieren; der Vorstellung von GPT-6.1 Sol, dessen Preise für Programmierung und langfristige Aufgaben stark gesenkt wurden, bis hin zur Verlagerung von Codex in die Cloud und sogar der offiziellen Öffnung des B2B-Marktes für inländische Modelle wie Zhipu GLM und Moonshot Kimi …
Zusammengefasst bricht OpenAI entschlossen die alte Hülle der „Chatfenster-Interaktion“ und wandelt sich zu einem Betriebssystem, das von autonomen Agenten in der Cloud angetrieben wird, um den gesamten Workflow von der Ideenfindung bis zur Umsetzung von Aufgaben zu verbinden.
Dennoch führten die häufig hängenden Echtzeit-Demonstrationen vor Ort, der „Adelspaket“ mit monatlichen Kosten von bis zu 500 US-Dollar sowie der drastische Kürzung der Leistungen des alten 200-Dollar-Pro-Abonnements zu viel Spott und Verspottungen.
Dots: Die OpenAI-Version von Muse
Das neue Produkt, das bei dieser Veröffentlichung im Mittelpunkt steht, heißt dots. Altman beschreibt es als „die authentischste KI-Form, die wir uns schon immer vorgestellt haben“.
Es ist nicht mehr nur ein Funktionszweig im Chatfenster, sondern im Wesentlichen ein autonomes Laufzeitsystem (Runtime) mit persistenter Ausführungsumgebung (eigener Sandbox einer virtuellen Maschine in der Cloud), Fähigkeit zur langfristigen Zielplanung über Systeme hinweg und Zugriffsrechte zur Authentifizierung externer Systeme.
dots wird von GPT-6 Astra angetrieben, verfügt über einen eigenständigen Cloud-Computer und Browser, läuft 7×24 Stunden im Hintergrund kontinuierlich und kann über Plugins mit mehr als 4000 externen Tools verbunden werden.
Das bedeutet, dass es nicht mehr passiv darauf wartet, dass Menschen sich bei ChatGPT anmelden und eine Unterhaltung starten, sondern seine Steuerungsschnittstelle direkt zu SMS, Slack, Microsoft Teams und allen anderen täglichen Kommunikationskanälen ausdehnt.
Der größte Unterschied zu herkömmlichen dialoggesteuerten KIs besteht darin, dass es sich von „passiver Antwort“ zu „langfristiger Aufgabenerfüllung“ wandelt. Sie müssen nicht vor dem Bildschirm sitzen und Prompt für Prompt eingeben, sondern nur das Ziel und die Messkriterien angeben, den Computer schließen – und es wird im Hintergrund in der Cloud stillschweigend die Aufgabe vorantreiben: es filtert externe Aktualisierungen in der späten Nacht, schiebt die drei dringendsten Angelegenheiten am Morgen vor, passt kollidierende Termine über verschiedene Software hinweg an, sammelt automatisch verstreutes Feedback ein, um Benutzern dabei zu helfen, ihre wertvollste „Aufmerksamkeit“ zurückzugewinnen.
Bei der Demonstration vor Ort nannte der Forscher seinen eigenen dot „Alfred“, der über das Mobiltelefon gesteuert werden kann. Von benennbaren Cartoon-Figuren bis hin zur Interaktionsweise des persönlichen Agenten erinnert Dots leicht an Muses von Meta und das gestern vom Manus-Team veröffentlichte Cue.
In dem gestrigen Bericht hat Cue zusätzlich einen Registrierungsprozess für „Mobilnummern“ hinzugefügt. Es ähnelt eher einer Sprachhülle für persönliche Agenten, die nur für Sprachanrufe geeignet ist, 0,99 US-Dollar pro Monat kostet (später auf 9,99 US-Dollar pro Monat angehoben) und diese Kosten sind zusätzlich zum Abonnement des Cloud-Computers zu zahlen.
Bei der Demonstration vor Ort zeigte dots eine tiefere Zusammenarbeit als herkömmliche automatisierte Skripte und kann fast alle unbedeutenden fragmentierten Angelegenheiten im Hintergrund übernehmen:
Am Morgen grüßt Sam es, Alfred hat bereits Slack und E-Mails durchgesehen, drei Angelegenheiten zusammengestellt, die er nach der Ankunft im Büro erledigen muss, und erinnert ihn sogar daran, den Kaffee zu trinken, bevor er weiterarbeitet. Diese Art des Debüts zeigt auch das Erlebnis, das OpenAI den Nutzern verkaufen möchte: Wenn Sie nach der KI suchen, ist sie bereits bereit.
Danach wird die Aufgabe schnell zu einem Problem, das Entwicklern vertraut ist: Eine alte Lagerbestands-API wird bald eingestellt, und der zugehörige Code muss migriert werden. Alfred in der Demonstration verfolgt Aufrufstellen, prüft Abhängigkeiten, aktualisiert die Integration und führt Tests durch. Auf GitHub erscheinen drei PRs, die Hintergrundaufgaben, die Kasse und das Abonnement sowie den alten API-Client behandeln.
In einer anderen Demonstration treibt Alfred die Aktualisierung der Website gemäß dem geprüften Design voran, bittet um Bestätigung, wenn eine menschliche Entscheidung für das Begleitbild erforderlich ist, und schließt dann die Veröffentlichung ab. Bis zu welchem Grad ein Agent eine Aufgabe vorantreiben kann und an welchen Punkten Menschen eingreifen müssen? dots hat auch eine beispielhafte Demonstration dafür geliefert.
Die Behörde hat auch einen früheren Testfall geteilt: Ein Tester hatte vergessen, der Verlagsrechnung zu stellen, der dot entdeckte dies, erstellte die Rechnung und sendete sie nach Genehmigung. Es wird erwartet, dass es sich Dinge merkt, Versäumnisse entdeckt und mit vorbereiteten Aufgaben zu den Menschen zurückkehrt.
Um die Bedenken von Unternehmen und Compliance-Abteilungen hinsichtlich des unkontrollierten Verhaltens von Agenten zu zerstreuen, hat OpenAI klare physische und Berechtigungsgrenzen in der Systemarchitektur festgelegt: Jeder dot läuft in isolierten Cloud-Containern, und beim Aufruf gespeicherter Anmeldeinformationen werden Klartext-Passwörter nicht dem Modell offengelegt.
Noch entscheidender ist sein Berechtigungsstufensystem: Wenn sich der dot im Hintergrundüberwachungszustand befindet, erhält er nur Leseberechtigungen für „aktive Recherchen“ und ist strengstens verboten, Nachrichten willkürlich zu senden oder Daten zu manipulieren; Schreiboperationen dürfen nur innerhalb des Aufgabenbereichs ausgeführt werden, dem der Benutzer ausdrücklich zugestimmt hat.
Dennoch steht die Robustheit von langfristigen Agenten in realen Netzwerkumgebungen weiterhin vor Herausforderungen. Bei der Demonstration vor Ort stieß der Ingenieur, der den „Dottie“-Agenten vorführte, auf lange Antwortverzögerungen und Sprachverzögerungen, was die Live-Kommentarbereiche dazu brachte, zu scherzen: „Die einzige Funktion vor Ort ist es, zu beweisen, dass es sich um eine echte Gerätemessung handelt“.
Außerhalb des Veranstaltungsorts gab es noch eine Episode im Stil von Elon Musk: Kurz nachdem OpenAI dots veröffentlicht hatte, entdeckten Internetnutzer, dass die Eingabe von dot.com zur Seite des Konkurrenten Grok Bot umleitet.
Derzeit steht Dots Benutzern der Ebenen Pro, Business Premium und Enterprise zur Verfügung, um den ersten Haupt-dot zu nutzen, und in Zukunft ist die Unterstützung der koordinierten Zusammenarbeit mehrerer dots geplant. Es ist erwähnenswert, dass obwohl die tägliche Kommunikation mit dem dot nicht auf das grundlegende Limit von ChatGPT angerechnet wird, die aufgerufene Codex- oder komplexe Berechnung immer noch das entsprechende Berechnungskontingent verbraucht.
Gleichzeitig ist diese Funktion aufgrund strenger Datenschutz- und Compliance-Prüfungen vorübergehend nicht in der Europäischen Union, Großbritannien und der Schweiz verfügbar.
Space: Der OpenAI-Büro-Agent
Wenn dots der ständig ansässige digitale Mitarbeiter ist, dann ist das neu eingeführte ChatGPT Space der „kollaborative Arbeitsplatz“, den OpenAI für diese Agenten und menschlichen Kollegen aufbaut.
Space ersetzt vollständig das ursprüngliche „