StartseiteArtikel

Massive Preissenkung für GPT-5.6 Sol: OpenAI weitet den Preiskrieg auf das Flaggschiff-Segment aus.

新智元2026-08-24 08:01
Finale der beiden ASI-Giganten: Der Preis ist zum zweiten Schlachtfeld geworden

Plötzliche Nachricht: GPT-5.6 Sol startet massive Preissenkungen

In den nächsten drei Monaten werden die API-Preise und die Kreditpreise (die nach dem Überschreiten des im Plan enthaltenen Kontingents nutzbaren On-Demand-Verbrauchswerte) um mehr als 20 % gesenkt.

Auf der API-Seite ist die Änderung sofort in Kraft, und qualifizierte ChatGPT Work- und Codex-Gutschriften werden schrittweise bereitgestellt.

Allerdings gibt es bei den drei Abonnementstufen Pro, Plus und Business keine einzige Preissenkung. Das im Paket enthaltene Nutzungsvolumen wurde ebenfalls nicht erhöht.

Die Senkung betrifft ausschließlich den nach Token berechneten Teil. Das heißt, je größer das API-Aufrufvolumen ist, desto mehr kann man sparen.

Wie viel kann man tatsächlich sparen?

Die vorherige API-Preisgestaltung von Sol betrug 5 USD pro Million Eingabe-Token und 30 USD pro Million Ausgabe-Token, was das teuerste Modell in der GPT-5.6-Familie war.

Wenn man jetzt die Preisseite öffnet, beträgt der Eingabepreis 4 USD und der Ausgabepreis 20 USD.

Der Eingabepreis ist um 20 % gesunken, das ist korrekt. Aber der Ausgabepreis wurde von 30 USD auf 20 USD gesenkt, was einem vollen Drittel entspricht.

Daher ist die offizielle Angabe, dass die Preise „um mehr als 20 %“ gesenkt wurden, noch zurückhaltend. Der wirklich teure Ausgabe-Token ist auf einmal um 33 % gefallen.

Angenommen, ein großes Agent verbraucht monatlich 100 Millionen Eingabe-Token und 20 Millionen Ausgabe-Token, kostete es früher 1100 USD, jetzt nur noch 800 USD, was einem Gesamtrückgang von etwa 27,3 % entspricht.

Wie viel man konkret spart, hängt vollständig von Ihrem Ein- und Ausgabeverhältnis ab. Bei Arbeiten wie der Stapelverarbeitung von Dokumenten mit hohem Eingabeanteil spart man etwa über 20 %; bei Szenarien wie dem intensiven Codieren in Codex, bei dem die Ausgabe dominiert, kann man über 30 % sparen.

Kurz gesagt: Je mehr Sie Sol als Produktivitätswerkzeug intensiv nutzen, desto mehr sparen Sie diesmal.

Die Cache-Stufe wurde ebenfalls angepasst: Der Cache-Eingabepreis sank von 0,5 USD auf 0,4 USD, der Cache-Schreibpreis von 6,25 USD auf 5 USD. Die Preise für lange Kontextfenster wurden ebenfalls gesenkt: Der Eingabepreis fiel von 10 USD auf 8 USD, der Ausgabepreis von 45 USD auf 30 USD.

OpenAI Developers kommentierte später im Thread: Die Preissenkung ist darauf zurückzuführen, dass Sol jetzt effizienter läuft.

Das Finale der beiden ASI-Führer: Der Preis wird zum zweiten Schlachtfeld

Bei der letzten Preissenkung von OpenAI war Sol das einzige Modell, dessen Preis unverändert blieb.

Luna wurde um ganze 80 % gesenkt, das Hauptmodell Terra um 20 %. Nur das Flaggschiff Sol behielt seinen ursprünglichen Preis bei und erhielt nur einen Fast-Modus, der die Geschwindigkeit ohne zusätzliche Kosten erhöht.

Damals war die Überlegung von OpenAI sehr klar: Günstige Modelle sorgen für hohe Nutzerzahlen, das teuerste Modell sichert die Position an der Spitze.

Diesmal tritt Sol selbst in den Wettbewerb ein. Zu diesem Zeitpunkt sieht das keineswegs wie ein Zufall aus.

Die Einschätzung des Tech-Influencers Chubby ist sehr direkt: Das zielt ganz offensichtlich auf Anthropic ab.

Anthropic hat derzeit Schwierigkeiten. Die negativen Rückmeldungen zu Opus 5 sind noch nicht verarbeitet, und die Geschwindigkeitsbegrenzungen des Fable 5-Abonnementplans werden von Nutzern heftig kritisiert.

Mit dieser massiven Preissenkung will OpenAI Nutzer von Anthropic abwerben.

Der Tech-Journalist Tae Kim drückte es noch härter aus: OpenAI nutzt hier ein paar Geschäftstaktiken während der IPO-Roadshow von Anthropic.

Diese Aussage ist nicht aus der Luft gegriffen.

Am 1. Juni dieses Jahres reichte Anthropic vertraulich das S-1-Dokument bei der SEC ein und leitete offiziell den IPO-Prozess ein. Laut Berichten mehrerer Medien haben die Emissionsbanken Mitte Juli begonnen, Treffen zwischen dem Management und potenziellen Investoren zu arrangieren, das Roadshow-Fenster liegt genau zwischen August und September.

Geplanter Börsengang: Frühestens im Oktober an der NASDAQ, mit einer angestrebten Bewertung von 2 Billionen US-Dollar.

Auf der Roadshow fürchtet man nichts mehr, als dass Konkurrenten Störungen verursachen.

Nach dem Ende der Benchmark-Wettbewerbe ist der Preis zum zweiten Schlachtfeld im Finale der beiden ASI-Führer geworden.

Dass OpenAI mutig die Preise stark senkt, ist kein spontaner Impuls.

Ihre früheren aggressiven Investitionen in eigene Rechenkapazitäten und die Fokussierung auf effizientere Modellarchitekturen zeigen jetzt ihre Wirkung.

Vor wenigen Tagen hat OpenAI angekündigt, am PORTS-Pike-Campus in Pike County, Ohio, etwa 8 IT-GW an Rechenkapazität gesichert zu haben, OpenAI hat einen Mietvertrag über 20 Jahre unterzeichnet; NVIDIA liefert exklusiv die KI-Recheninfrastruktur.

Zuvor hatte OpenAI mit Oracle eine fünfjährige Zusammenarbeit im Wert von über 3000 Milliarden US-Dollar mit einer maximalen zusätzlichen Kapazität von 4,5 GW vereinbart und mit AMD eine Vereinbarung zur Bereitstellung von 6 GW an GPUs unterzeichnet.

OpenAI bestätigte im April dieses Jahres, dass die gesicherte KI-Infrastrukturkapazität über 10 GW beträgt, mit dem Ziel, sie bis 2030 auf 30 GW auszubauen.

Je vollständiger die Infrastruktur ist, desto niedriger sind die Grenzkosten und desto größer ist der Spielraum für Preissenkungen. Das ist ein positiver Kreislauf: Verbesserte Modelleffizienz → sinkende Inferenzkosten → freier Preisspielraum → Zustrom von Nutzern → steigende Einnahmen → weitere Investitionen in die Infrastruktur.

Man kann sagen, dass dieser Kreislauf von OpenAI gerade in Fahrt kommt. Sie haben selbst angegeben, dass GPT-5.6 Sol an der Optimierung seines eigenen Inferenz-Kerns beteiligt war, wodurch die End-to-End-Servicekosten um 20 % gesenkt und die Effizienz der Token-Generierung um über 15 % gesteigert werden konnte.

Aber diese Preissenkung ist nicht nur eine aktive Erzeugung von Druck, sondern hat auch einen erzwungenen Anteil.

DeepSeek V4 Flash wurde am 31. Juli offiziell veröffentlicht, zu Preisen, die fast kostenlos erscheinen.

Noch aufregender ist ein geheimes Modell mit dem Codenamen „Ox Alpha“, das vor zwei Tagen auftauchte. Es hat ein Kontextfenster von 1 Million, unterstützt Text-, Bild- und Videoeingaben und ist eine Woche lang kostenlos nutzbar.

Inzwischen sind die chinesischen Open-Source-Modelle nicht nur günstig, sondern ihre Fähigkeiten nähern sich auch ständig den Spitzenmodellen an.

Daher ist diese Preissenkung von Sol sowohl ein aktiver Angriff auf Anthropic als auch eine Verteidigungsreaktion gegen die günstigen chinesischen Modelle.

Codex überschreitet 20 Millionen Nutzer

Am selben Tag gab es noch weitere Zahlen.

Der Leiter von Codex, Tibo, gab bekannt, dass die aktiven Wochennutzer von Codex die Marke von 20 Millionen überschritten haben.

Um diesen Meilenstein zu feiern, hat das Team allen Nutzern von Codex und ChatGPT Work eine einmalige BANKED-Kontingenterneuerung gewährt.

Aber bezüglich des von der Community gemeldeten Problems des zu schnellen Verbrauchs des Kontingents sagte Tibo, dass bisher keine Anomalien festgestellt wurden, aber eine offizielle Untersuchung wurde bereits gestartet, und die Ergebnisse werden umgehend mitgeteilt.

Er hat zudem eine klare Regel festgelegt: Die Umwandlung von Abonnementkonten in API-Traffic über sub2api zur anschließenden Weiterverkauf oder gemeinsamen Nutzung durch mehrere Personen wird von der Seite nicht unterstützt. Solche Nutzungsweisen werden direkt vom Risikokontrollsystem markiert.

Der Weg, ein Monatsabonnement-Konto an hundert Personen weiterzuverkaufen, ist damit blockiert.

Die normale Nutzung über den offiziellen Client oder Open-Source-Clients wie Pi und OpenCode ist völlig unproblematisch.

Referenzquellen:

https://x.com/OpenAI/status/2090885187634905500

https://x.com/OpenAI/status/2090885188897460249

https://x.com/kimmonismus/status/2090890956287492564

https://x.com/rohanpaul_ai/status/2090885980849050036

https://x.com/rohanpaul_ai/status/2090891370663989566

https://x.com/thsottiaux/status/2090766694897619318

Dieser Artikel stammt vom WeChat-Offiziellen Konto „New Zhiyuan“, Autor: ASI Offenbarung, Redakteur: Solomon, veröffentlicht mit Genehmigung von 36Kr.