En modell som poängsätter alternativ i stället för att skriva meningar

Microsoft har släppt Microsoft-Decision-1, en modell som tar en fråga med en fast uppsättning svar och returnerar en kalibrerad sannolikhet för vart och ett. Den skriver ingen löpande text. Den presenterades på torsdagen av Achint Srivastava, vice vd för programvaruutveckling på Office of the CTO, och är Microsofts bidrag till en kategori som inte fanns i juni.

Modellen är en eftertränad version av Alibabas öppna Qwen3.5-9B, anpassad för beslutspoängsättning i ett enda svep. Microsoft uppger att man senare kommer att basera samma system på andra modeller, bland annat den egna MAI-familjen och OpenAI:s. Den klarar ja/nej-frågor, flervalsfrågor och betygsskalor, samt rubrikbaserad bedömning av andra modellers svar och av agenters handlingar.

Siffrorna är Microsofts egna

Microsoft skriver att Decision-1 “uppnådde den högsta träffsäkerheten i vår jämförelse med 36 tester”, en uppsättning på nära 150 000 frågor som enligt företaget hölls dolda under träningen, och som täcker routning, rangordning, långa sammanhang, flerspråkiga och fördelningsfrämmande uppgifter, resonemang och säkerhet. Jämförelsen innehöll flera av de främsta modellerna från JevBench-listan. Det är resultat som leverantören själv kört, och ingen oberoende utvärdering har publicerats.

Händer som håller en uppfälld solfjäder av färgprover
Microsoft uppger att åtta slags störningar av indata ändrade beslutet 1,3 procent av gångerna. Illustrerande foto. Tima Miroshnichenko · pexels · Pexels License

Om stabiliteten uppger företaget att modellens beslut vid åtta slags störningar av indata ändrades i genomsnitt 1,3 procent av gångerna, och att omskrivna alternativbeskrivningar eller omkastad ordning inte gav några ändringar alls. På säkerhetssidan uppger man sig ha testat 5 250 förfrågningar i elva tester om skadligt innehåll, kringgående av spärrar och promptinjektion, utan att ange något resultat.

Priset är argumentet

Decision-1 kostar 0,042 dollar per miljon indatatokens. Utdatatokens är gratis, vilket följer av konstruktionen: det finns i praktiken inga utdatatokens. Microsoft anger modellens medianlatens till ungefär 35 gånger snabbare än GPT-6 Sol, och 2,5 gånger snabbare än tvåan i jämförelsen, H2O-Lightning-4B v1.1.

Staplade kortregisterlådor i metall märkta med nummerintervall
Modellen säljs för routning och bedömning till 0,042 dollar per miljon indatatokens. Illustrerande foto. Magda Ehlers · pexels · Pexels License

Den finns via Microsoft Foundry och på OpenRouter, med dokumentation på Microsoft Learn. Microsoft har inte sagt vilken licens vikterna har, eller om de publiceras alls.

Fyra trånga månader

Kategorin började med Jev från TypeSafe AI i mitten av september och har fyllts på sedan dess: OpenAI släppte ett beslut-API den här månaden, Cloudflare har en öppen familj som heter Clef, och Amazon släppte en kopia. The Decoder noterade att Cloudflares Clef-modeller, som också bygger på Qwen, utelämnades ur Microsofts jämförelse.

Det som bör följas är ombaseringen. Microsoft har i sitt eget tillkännagivande sagt att Qwen3.5-9B är en utgångspunkt snarare än målet, vilket gör Decision-1 till den ovanliga produkten från ett ledande labb som pekar ut en öppen kinesisk modell som sin nuvarande grund.