StartseiteArtikel

Seine Geschwindigkeit ist 35 Mal so hoch wie die von GPT-6 Sol. Microsoft hat ein Hochgeschwindigkeits-KI-Modell für Entscheidungsfindung vorgestellt, das bei 36 Tests die höchste Genauigkeit erzielt und den ersten Platz belegt.

36氪的朋友们2026-10-10 09:50
Derzeit ist Microsoft-Decision-1 bereits über Microsoft Foundry, die KI-Entwicklungsplattform von Microsoft, für Entwickler freigegeben, und die Unterstützung für die Anbindung von OpenRouter befindet sich ebenfalls in der Planung.

Microsoft hat eine neue Generation von KI-Modellen vorgestellt, die speziell für strukturierte Entscheidungsaufgaben entwickelt wurde und bei Geschwindigkeit und Kosten die bestehenden großen Sprachmodelle weit übertrifft.

Am Freitag hat Microsoft das neue KI-Modell für schnelle Entscheidungen Microsoft-Decision-1 vorgestellt, das speziell für strukturierte Entscheidungsaufgaben konzipiert ist.

Laut Microsoft wurde die P50-Version von Microsoft-Decision-1 bereits in mehreren internen Szenarien getestet, darunter Unfallreaktion, Qualitätskontrolle und wissenschaftliche Entdeckung. Ihre Laufgeschwindigkeit ist 35-mal so hoch wie die von OpenAIs GPT-6 Sol und 4,5-mal so hoch wie die von Quyet-1.0-Large.

Vorstandsvorsitzender Satya Nadella hat auf X veröffentlicht, dass dieses Modell "bei strukturierten Entscheidungsaufgaben hervorragende Leistungen erbringt und in Bezug auf Latenz und Qualität sowohl große Sprachmodelle als auch andere Entscheidungsmodelle übertrifft", und es wird bereits intern bei Microsoft in Szenarien wie Unfallreaktion, Qualitätskontrolle und wissenschaftlicher Forschung getestet.

Was die Preisgestaltung betrifft, beträgt die Gebühr für die Eingabeseite dieses Modells 0,042 US-Dollar pro Million Tokens, während die Ausgabe kostenlos ist. Diese Struktur ist für hochfrequente, wiederholende Entscheidungsanwendungen in Bezug auf die Kosten offensichtlich attraktiv.

01

Auf Entscheidungen konzentriert, die Lücken in den Fähigkeiten großer Sprachmodelle schließt

Im Gegensatz zu herkömmlichen großen Sprachmodellen, die sich auf Textgenerierung und komplexes Schlussfolgern konzentrieren, ist das Designziel von Microsoft-Decision-1 fokussierter.

Das Microsoft-Decision-1-Modell wählt die optimale Lösung aus voreingestellten Optionen aus und weist jeder alternativen Antwort eine Wahrscheinlichkeitsbewertung zu, um nachgelagerte Anwendungen dabei zu unterstützen, zu entscheiden, ob sie fortfahren, neu versuchen, die Eskalation durchführen oder eine menschliche Prüfung durchführen sollen.

(Microsoft-Decision-1 belegt den ersten Platz bei der Genauigkeit und ist das Modell mit der schnellsten gemessenen Geschwindigkeit)

Microsoft gibt an, dass dieses Modell bei der Genauigkeit in allen 36 Benchmark-Tests mit fast 150.000 Fragen den ersten Platz belegt. Seine Funktionspositionierung umfasst Routing, Inhaltsklassifizierung, Aufgabenpriorisierung, Ergebnisvalidierung und Workflow-Steuerung und kann nahtlos in vorhandene Anwendungen, KI-Agenten und Workflow-Systeme eingebettet werden.

Allerdings stammen die oben genannten Leistungsdaten aus den eigenen Benchmark-Tests von Microsoft, und eine unabhängige Überprüfung durch Dritte ist noch nicht abgeschlossen.

02

Interne Tests zeigen deutliche Vorteile bei Geschwindigkeit und Kosten

Microsoft betont, dass jede Entscheidung die Latenz erhöht, insbesondere wenn ein Schritt von einem anderen abhängt. Wenn beispielsweise 20 Entscheidungen nacheinander getroffen werden und jede Entscheidung 100 Millisekunden hinzufügt, erhöht sich die gesamte Arbeitsablaufdauer um 2 Sekunden.

Die Latenzgeschwindigkeit von Microsoft-Decision-1 P50 ist 35-mal so hoch wie die von GPT-6 Sol.

(Zeit für die Generierung einer Entscheidung bei einer einzelnen Anfrage, niedrigere Werte sind besser, Medianwert des JevBench-Testdatensatzes)

Das Xbox Research-Team hat es verwendet, um mehr als 10.000 Spielrückmeldungen zu klassifizieren. Die Ergebnisse zeigen, dass die Qualität mit der von GPT-6 Sol vergleichbar ist, die Geschwindigkeit jedoch mehr als 14-mal so hoch ist und die Kosten um etwa das 200-fache gesenkt werden. Auch das Microsoft Copilot-Team hat festgestellt, dass dieses Modell bei der KI-Antwortbewertungsaufgabe ähnliche Leistungen wie GPT-5.6 Luna erbringt.

(Bei der Klassifizierung desselben Textes betragen die Kosten von Microsoft-Decision-1 nur ein paar Zehntel der Kosten von GPT-6 Sol)

In Bezug auf die technische Architektur ist Microsoft-Decision-1 auf Basis von Qwen3.5-9B aufgebaut und wurde einem speziellen Nachtraining unterzogen, das sich auf die Bewertung einzelner Entscheidungen konzentriert.

Microsoft plant außerdem, dieses Modell in Zukunft auf andere Basismodelle wie seine MAI-Serie und OpenAI-Modelle zu portieren.

In seiner Ankündigung betont Microsoft, dass dieses Modell darauf abzielt, "Entscheidungsintelligenz in einer sicheren und vertrauenswürdigen Umgebung in vorhandene Anwendungen zu integrieren", und positioniert es als eine der grundlegenden Komponenten für die Orchestrierung von KI-Agenten-Workflows.

03

Robustheit und Sicherheit werden besonders hervorgehoben

Microsoft hat bei dem Design die Stabilität des Modells besonders berücksichtigt.

Testdaten zeigen, dass nach der Störung derselben Anfrage in acht Formen bei Microsoft-Decision-1 nur eine durchschnittliche Wahrscheinlichkeit von 1,3 % besteht, dass sich die Entscheidung umkehrt, und in Szenarien wie der Umformulierung der Optionsbeschreibung oder der Umkehrung der Optionsreihenfolge beträgt die Umkehrrate null.

In Bezug auf die Sicherheit hat Microsoft dieses Modell mit 5250 Anfragen in 11 Benchmarks getestet, die schädliche Inhaltserkennung, Jailbreak-Angriffe und Prompt-Injektion umfassen. Es wird angegeben, dass das Modell schädliche Anfragen erfolgreich ablehnt und gleichzeitig eine hohe Nutzungsleistung für den normalen Gebrauch beibehält.

Derzeit ist Microsoft-Decision-1 für Entwickler über Microsoft Foundry, die KI-Entwicklungsplattform von Microsoft, verfügbar, und die Unterstützung für die Integration von OpenRouter ist ebenfalls geplant.

Dieser Artikel stammt aus dem WeChat-Offiziellen Konto „Wallstreet News Max“, Autor: BAO Yilong, veröffentlicht mit Genehmigung von 36Kr.