Gerade hat ChatGPT Textwasserzeichen eingeführt, GPT-6 wurde um 50 % beschleunigt.
Nur wenige KI-Hersteller sind davon überzeugt, dass ihre veröffentlichten Produkte „Qualität durch Quantität“ erreichen können – OpenAI gehört ausgerechnet zu ihnen.
Wie schon bei der heldenhaften Aktion, 12 Tage lang nacheinander Pressekonferenzen abzuhalten, kündigte Thibault Sottiaux, Leiter von OpenAI Codex (den alle als Tibo kennen), gestern eine 28 Tage andauernde Zusage an:
Jeden einzelnen Tag in der kommenden Zeit wird das Team entweder ein Update veröffentlichen, das für die meisten Nutzer von Codex oder ChatGPT Work einen deutlichen Mehrwert bietet, oder eine vollständige Rücksetzung des Nutzungslimits durchführen.
Am ersten Tag der Aktion lautet das Ergebnis von OpenAI eine Geschwindigkeitssteigerung. Bei der Nutzung von GPT-6 Astra und GPT-6.1 Sol über Abonnements wird die Standardgeschwindigkeit um ca. 50 % erhöht, ohne dass Nutzer Einstellungen anpassen müssen.
Am selben Tag veröffentlichte OpenAI zudem zwei weitere völlig anders ausgerichtete Änderungen. Teilweise Textausgaben von ChatGPT und Codex werden künftig mit unsichtbaren Wasserzeichen versehen, während das Werbegeschäft von ChatGPT eine intuitivere Bilddarstellungsform einführen wird.
Zusammengenommen verdeutlichen diese Aktualisierungen die aktuelle Situation von OpenAI sehr gut. Das Unternehmen muss dafür sorgen, dass zahlende Abonnenten ihr Abonnement als wertvoller empfinden, den Aufsichtsbehörden erklären, wo die KI-Inhalte herkommen, und gleichzeitig die wachsende Nutzerbasis zu einem Geschäft machen, für das Werbetreibende bereit sind zu zahlen.
Abgesehen von Modellen nähern sich die täglichen Angelegenheiten, mit denen KI-Plattformen konfrontiert sind, immer mehr dem uns vertrauten Internet an.
Tägliche Aktualisierungen – Nutzer erwarten eine nutzbare Verbesserung
Tibos Zusage enthält eine beachtenswerte Einschränkung: Die täglich veröffentlichten Verbesserungen müssen für die meisten Codex- oder Work-Nutzer relevant sein und eine ausreichend deutliche Wirkung zeigen.
Mit anderen Worten: Eine kleine, versteckte Funktion kann die Erwartungen der Nutzer an diese Zusage kaum erfüllen. Für Menschen, die täglich mit KI arbeiten, wirken sich Wartezeit, Bedienfreundlichkeit und ausreichende Nutzungslimits direkt darauf aus, ob sie bereit sind, weiterhin zu zahlen.
Die Geschwindigkeitssteigerung am ersten Tag entspricht genau diesem Bedarf.
Laut Tibos Angaben gilt die Standardgeschwindigkeitsoptimierung für GPT-6 Astra und GPT-6.1 Sol sowohl für die Abonnementprodukte von OpenAI als auch für Partner, die „Anmelden mit ChatGPT“ unterstützen, einschließlich OpenCode, Pi, Amp und Devin.
Nutzer, die die Abonnementfunktionen über ihre ChatGPT-Konten in diesen Tools verwenden, fallen ebenfalls unter diese Anpassung. Er gab an, dass die Änderungen innerhalb von zwei Stunden nach der Ankündigung schrittweise von den Nutzern wahrgenommen werden.
Anschließend nannte Tibo eine genauere Zahl: Die Generierungsgeschwindigkeit steigt von 30 Token pro Sekunde auf 50 Token pro Sekunde.
Für Arbeiten, bei denen man kontinuierlich mit dem Modell interagieren muss, ist die Geschwindigkeitssteigerung nach wie vor von praktischer Bedeutung. Beim Schreiben von Code müssen Dateien wiederholt gelesen, geändert, getestet und Fehler korrigiert werden, auch bei der Zusammenstellung von Materialien sind mehrere Such- und Generierungsvorgänge möglich. Wenn die einzelne Wartezeit kürzer wird, fällt der kumulative Unterschied im Nutzungserlebnis noch deutlicher auf.
Vielleicht ist die Rücksetzung des Nutzungslimits sogar noch praktischer als die Geschwindigkeitssteigerung – wir freuen uns darauf, dass dies in den 28 Tagen mehrmals geschieht.
Wasserzeichen für Texte hinzufügen und die Grenzen von Wasserzeichen anerkennen
Die Geschwindigkeitssteigerung erleichtert Nutzern die Verwendung von KI, während Textwasserzeichen eine weitere Frage beantworten: Wenn generierte Inhalte in E-Mails, Artikeln, Berichten und öffentlichen Diskussionen auftauchen, kann die Außenwelt dann noch erkennen, dass sie von KI erzeugt wurden?
Ebenfalls heute veröffentlichte OpenAI seine Lösung zur Einhaltung der EU-Regeln zur Herkunft von Texten. Laut der Ankündigung verlangt das EU-KI-Gesetz von Anbietern generativer KI, dass erzeugte Texte maschinenlesbar identifiziert werden können.
Globale API-Kunden können ab sofort das Textwasserzeichen für einige Modelle manuell aktivieren, die Standardeinstellung bleibt weiterhin deaktiviert.
In den kommenden Wochen wird OpenAI im EU-Raum unsichtbare Wasserzeichen für berechtigte Textausgaben von ChatGPT und Codex hinzufügen, die alle Tarife abdecken, aber in der ersten Phase nicht als globale Standardfunktion festgelegt werden.
OpenAI nennt diese Technologie textGrain. Sie fügt unsichtbare statistische Signale hinzu, wenn das Modell Wörter auswählt, und Erkennungstools suchen nach diesen Signalen, um zu beurteilen, ob ein Text ein OpenAI-Wasserzeichen enthält. OpenAI plant zudem, die Technologie als Open Source freizugeben.
Die Schwierigkeit liegt darin, dass Texte sehr einfach verändert werden können und die Ausdrucksmöglichkeiten, die das Modell zur Auswahl hat, je nach Inhalt variieren.
Unter Testbedingungen mit einer Ziel-Falsch-Positiv-Rate von 1 % können Erkennungstools bei Inhalten wie Psychologie ca. 80 % der 200-Token-langen Wasserzeichen-Texte erkennen; bei einer Länge von 400 Token liegt die Erkennungsrate bei ca. 95 %. Bei mathematischen Inhalten, die weniger Ausdrucksspielraum bieten, ist die Erkennungsleistung deutlich niedriger.
Bearbeitungen schwächen zudem die Signale. In einem weiteren Test mit 400-Token-langen Texten sinkt die Erkennungsrate von ca. 92 % auf 66 %, wenn 10 % der Wörter durch Synonyme ersetzt werden; bei einem Ersatzanteil von 25 % liegt die Erkennungsrate nur noch bei 17 %.
Diese Zahlen zeigen, dass Textwasserzeichen Hinweise liefern können, aber es noch ein weiter Weg ist, um den Erstellungsprozess eines Artikels zuverlässig zu beurteilen. OpenAI gab zudem an, dass in den Benchmark-Tests zur Bewertung von Astra keine sinnvollen Leistungsunterschiede vor und nach dem Hinzufügen von Wasserzeichen beobachtet wurden – diese Tests decken jedoch nicht alle tatsächlichen Schreibszenarien ab.
Die wichtigste Grenze ist, dass Wasserzeichen den menschlichen Beitrag nicht messen können.
Wenn eine Person einen Artikel selbst verfasst und dann die KI die Ausdrücke anpassen lässt, oder wenn die KI den gesamten Text generiert, kann in beiden Fällen das Modell den Text verarbeiten. Das Erkennen eines Wasserzeichens sagt nichts darüber aus, wie viel Urteil, Bearbeitung und Kreativität der Autor eingebracht hat, und es kann auch nicht zur Bestimmung von Urheberrecht, Verantwortung oder Echtheit des Inhalts verwendet werden.
Wasserzeichen verknüpfen zudem keine bestimmten Nutzer, Konten, Prompts oder Gespräche. Umgekehrt bedeutet das Fehlen eines erkannten Wasserzeichens nicht, dass der Text von einem Menschen unabhängig erstellt wurde: Zu kurze Texte, bearbeitete oder übersetzte Texte oder Texte von Modellen, die keine Wasserzeichen unterstützen, können dazu führen, dass das Signal nicht erkannt wird.
Da Falsch-Positive und Falsch-Negative nach wie vor auftreten, öffnet OpenAI vorerst nur zugelassenen Forschern und Fachinstitutionen die Antragstellung für das Erkennungstool, statt es bei der Veröffentlichung vollständig für die Öffentlichkeit freizugeben.
Wenn ChatGPT wöchentlich 1,2 Milliarden Menschen erreicht: Werbung nimmt vertraute Formen an
Verglichen mit Wasserzeichen machen visuelle Werbungen die Änderungen des Produkts für normale Nutzer leichter wahrnehmbar.
In derselben Ankündigung gab OpenAI an, dass ChatGPT wöchentlich 1,2 Milliarden Menschen erreicht. Für eine Plattform dieser Größenordnung sind kommerzielle Einnahmen außerhalb von Abonnements bereits Teil der Produktentwicklung.
Die neu angekündigte Werbeform wird Produktideen, Nutzungsmethoden oder zugehörige Erfahrungen durch Bilder darstellen. Die ersten Testpläne starten später in diesem Monat in den USA, in Zusammenarbeit mit einer Gruppe erster Werbetreibender werden die Szenarien während des Bildgenerierungsprozesses von ChatGPT ausgewählt.
Laut OpenAI werden die Werbungen klar gekennzeichnet und von den generierten Bildern getrennt gehalten, sie beeinflussen auch nicht die Antworten von ChatGPT.
Die Wahl der Bildgenerierung als Testszenario hat ihre eigene kommerzielle Logik.
Wenn Nutzer Raumgestaltungen, Aktionspläne oder Lebensstile entwerfen, machen Bilder die Nutzungsszenarien von Produkten intuitiver und erleichtern es Marken, in die Überlegungen der Nutzer einzudringen. Ob dies zu einem ausreichend guten Nutzungserlebnis führt, wird der Test zeigen müssen.
OpenAI erweiterte gleichzeitig die Tools zur Messung der Werbewirkung und arbeitet mit Plattformen wie Hightouch, Tealium und LiveRamp zusammen, damit Werbetreibende die Konversionsdaten aus ihren vorhandenen Systemen an ChatGPT Ads zurücksenden und weitere Partner für Attribution und Wirkungsevaluierung einbinden können.
Für Werbetreibende ist die eigentliche Frage, die beantwortet werden muss: Haben Nutzer nach dem Ansehen der Werbung einen Kauf getätigt, und wie viel von diesen Käufen hätte ohnehin stattgefunden?
OpenAI veröffentlichte erste Ergebnisse mehrerer Partner.
DV Rockerbox gab an, dass die attribuierte Kundengewinnungskosten von WeightWatchers bei ChatGPT Ads 15,3 % unter seinem kombinierten Benchmark für bezahlte Suchanzeigen liegen; WorkMagic teilte mit, dass 67 % der inkrementellen Käufe der Gesundheitsmarke Dose von komplett neuen Kunden stammen; Triple Whale gab an, dass 93 % der Besucher von Portland Leather, die über ChatGPT Ads kamen, neue Besucher waren.
Zudem benötigt die Platzierung von Werbungen neue Regeln. OpenAI gab an, zu bewerten, ob ein Gespräch für die Anzeige von Werbung geeignet ist, um Platzierungen in emotional sensiblen, heiklen oder anderen ungeeigneten Kontexten zu vermeiden, und mit DoubleVerify sowie Integral Ad Science an der Bewertung der Markenpassung zusammenzuarbeiten.
Laut der Ankündigung werden