Microsoft hat Microsoft Decision-1 vorgestellt, ein Modell, das auf extrem schnelle und günstige strukturierte Entscheidungen spezialisiert ist. Am 9. Oktober 2026 in Microsoft Foundry gestartet, Microsoft Decision-1 basiert auf Alibabas Qwen3.5-9B und ist auch über OpenRouter verfügbar.
Was ist passiert?
Anstatt Text wie ein traditionelles LLM zu generieren, erhält Microsoft Decision-1 einen festen Satz von Optionen (Ja/Nein, Multiple Choice, Ratings oder Rubriken) und gibt in einem einzigen Durchgang eine kalibrierte Wahrscheinlichkeit für jede zurück. Microsoft behauptet, dass es in einem Set von 36 Benchmarks mit fast 150.000 Fragen die höchste Genauigkeit hatte und etwa 35-mal schneller als GPT-6 Sol ist.
Der Preis liegt bei 0,042 US-Dollar pro Million Eingabe-Token, mit kostenloser Ausgabe — derselbe wie bei TypeSafes Jev. Das Unternehmen plant, das Modell in Zukunft auf eigene MAI-Grundlagen und OpenAI-Modelle umzubasieren. Mehr Details auf dem offiziellen Microsoft-Blog.
Warum ist das wichtig?
In KI-Agenten und Workflows sind die meisten Schritte einfache Klassifikationen, Routings oder Verifizierungen. Ein großes generatives Modell für jeden davon treibt Kosten und Latenz hoch. Ein dediziertes Entscheidungsmodell wie Microsoft Decision-1 ermöglicht modularere und effizientere Architekturen.
Intern nutzt Microsoft es bereits für Game-Feedback-Labeling bei Xbox, Qualitätskontrolle in Copilot, Incident Response und Replanung in wissenschaftlichen Experimenten.
Was ändert sich in der Praxis?
Entwickler können Microsoft Decision-1 für Ticket-Triage, Modell-Routing, Agenten-Antwortbewertung oder Alert-Priorisierung integrieren, ohne die Kosten eines GPT-6 zu zahlen. Die P50-Latenz liegt bei etwa 85 ms und eignet sich für sequenzielle Pipelines.
Das Modell generiert keine Erklärungen; dafür wird es mit einem LLM kombiniert. Es ist text-only und hat ein 32k-Token-Fenster. Schauen Sie es auch auf OpenRouter an.
Bildnachweis: Microsoft — Quelle: offizielle Ankündigung auf X und Command Line Blog
Von GeekikiBot