Seks modeller i én lansering

Institute of Foundation Models, laboratoriet i Abu Dhabi som MBZUAI grunnla i mai 2025, slapp K2 Horizon 3. september: seks modeller på 0,9, 3,7, 7 og 32 milliarder parametere som tette modeller, pluss to spredte ekspertblandingsmodeller på 36 milliarder med om lag 4 milliarder aktive parametere og 375 milliarder med om lag 23 milliarder aktive.

IFM gir hver størrelse en oppgave i stedet for å behandle dem som samme modell krympet ned. Den minste retter seg mot maskinvare i kanten av nettet, mellomstørrelsene mot agenter på enheten og lokal drift, og modellen på 375 milliarder mot større resonnements- og agentarbeid. Ifølge modellkortene har modellene et kontekstvindu på 524 288 tokens, og IFM oppgir at hver av dem ble førtrent på rundt 20 billioner tokens.

Vekter og kode er Apache 2.0. Datasettene beholder sine egne lisenser, blant annet ODC-BY der videreformidling er tillatt.

Påstanden som gjør forskjellen

Mange laboratorier publiserer vekter. IFMs poeng er at vekter alene ikke er åpen kildekode.

“Åpen kildekode er mye mer enn åpne vekter”, sa Eric Xing, IFMs grunnlegger. “Vitenskap fungerer når andre kan se dataene, følge metoden, reprodusere resultatet og forbedre det.”

Hyller i et åpent biblioteksarkiv fylt med bøker
IFMs argument er at reproduserbarhet krever dataene og metoden, ikke bare vektene. Mario Spencer · pexels · Pexels License

Lanseringen skal omfatte treningskode, konfigurasjoner, mellomliggende kontrollpunkter, detaljerte logger, evalueringsresultater og selve treningsdataene — med oppskrifter på hvordan datasett er bygget der de ikke kan videreformidles. Hector Liu, som leder IFMs laboratorium i Silicon Valley, oppsummerte omfanget: “I stedet for å slippe én enkelt modell slipper vi en hel flåte.”

Det er en klart sterkere forpliktelse enn de åpne vektslippene bransjen har vent seg til, og det er den delen som er verdt å kontrollere framfor å gjengi.

Hva som faktisk ble levert dag én

Åpenheten kommer i etapper. Etter å ha gjennomgått modellkortene melder CellCog at modellene på 3,7 og 7 milliarder kom med hele pakken — vekter, data og oppskrifter, kode og mellomliggende kontrollpunkter — mens flaggskipet på 375 milliarder og den spredte modellen på 36 milliarder ble sluppet med bare vekter, der kortene oppgir at kontrollpunkter, data og treningskode vil bli publisert. Modellen på 32 milliarder er merket som et kontrollpunkt i første trinn, med en endelig versjon som gjenstår.

Modellene de fleste forskere ville ønsket å reprodusere, er dermed foreløpig de med minst publisert bak seg. Det er ikke et brutt løfte, det er et ennå uinnfridd, og forskjellen betyr noe bare hvis resten kommer.

Abu Dhabis silhuett med høye tårn i skumringen
K2 Horizon er det andre store programmet for åpne modeller som er annonsert fra Gulfen samme uke. Jennifer · pexels · Pexels License

Ytelse og hvor man får tak i den

IFM oppgir at de tre minste modellene setter ny standard i sine størrelsesklasser. Tallene er laboratoriets egne; uavhengig evaluering har ennå ikke rukket å følge etter, og ingen leverandørmåling bør leses som et avgjort resultat.

Vektene ligger på Hugging Face — plattformen Nvidia samme uke ble enig om å kjøpe for 12,93 milliarder dollar — og kjører under vLLM, SGLang og Ollama. API-tilgang tilbys gjennom Compass, Cerebras, AWS og Nebius.

Hva som er verdt å følge

To ting avgjør om K2 Horizon er det den utgir seg for å være. Først om treningsdataene og koden for modellene på 375 og 36 milliarder publiseres, og når. Deretter om uavhengige evalueringer reproduserer påstandene per størrelsesklasse. Inntil begge innfris, er dette et svært stort åpent vektslipp med et løfte om åpen vitenskap vedlagt.