Et gigawatt i Indre Mongolia

DeepSeek planlegger å installere minst 160 000 Huawei Ascend 950DT-akseleratorer i et datasenter under bygging i Ulanqab i Indre Mongolia, med mål om rundt ett gigawatt kapasitet når anlegget står ferdig. Bloomberg omtalte bestillingen 4. september med henvisning til personer med kjennskap til planen; tallet er siden beskrevet i detalj av bransjemedier som dekker det kinesiske akseleratormarkedet.

Gjennomføres den i den skalaen, blir den blant de største offentlig beskrevne klyngene bygd rundt Huaweis KI-silisium. Verken DeepSeek eller Huawei har offentliggjort avtalen.

Bare inferens

Det viktige er hva brikkene ikke skal gjøre. 950DT-utrullingen er ment for inferens — å levere modeller til brukerne — og DeepSeek har til hensikt å fortsette å trene på Nvidia-maskinvare, ifølge omtalen av planen.

Den delingen sier noe om programvaren, ikke om transistorene. Å trene en frontmodell i stor skala forutsetter en moden stakk for distribuert trening: biblioteker for kollektiv kommunikasjon, sjekkpunkter, feiltoleranse over titusenvis av enheter og kjerner som er slipt gjennom år i produksjon. Inferens krever langt mindre. En lab kan sette en kinesisk akselerator bak API-et sitt lenge før den vil satse en flere måneder lang treningskjøring på den.

En prosessorbrikke montert på et kretskort, sett på nært hold
950DT har 144 GB minne med høy båndbredde, ifølge spesifikasjonene som fulgte omtalen. Arkivbilde. Laura Paredis · pexels · Pexels License

Hva 950DT er

Ascend 950DT har 144 GB minne med høy båndbredde og omtrent 4 terabyte per sekund, ifølge spesifikasjonene som følger omtalen. Per brikke ligger det bak Nvidias nåværende generasjon. Ved 160 000 enheter betyr det mindre: for å levere modeller er det den samlede minnemengden og den samlede båndbredden i hele flåten som avgjør hvor mange samtidige forespørsler et anlegg klarer, og en stor nok flåte veier opp for en svakere komponent.

Begrensningen er minne, ikke fabrikker

Huaweis produksjon av 950DT ventes å ligge i lave hundretusener enheter i året, og den begrensende faktoren som nevnes, er høybåndbreddeminne snarere enn kapasitet til å produsere logikkbrikker. Med den regnestykket ville alene DeepSeeks bestilling sluke en stor del av et års produksjon, og leveringen kan strekke seg forbi tolv måneder. Anlegget ventes å være delvis i drift mellom slutten av 2027 og begynnelsen av 2028.

En stor datasenterbygning under oppføring på et åpent område
Anlegget i Ulanqab ventes å være delvis i drift mellom slutten av 2027 og begynnelsen av 2028. Arkivbilde, ikke Ulanqab. EqualStock IN · pexels · Pexels License

Hvorfor dette er brikkepolitikk

De amerikanske eksportkontrollene ble skrevet for å holde avanserte akseleratorer borte fra kinesiske datasentre. Det de har produsert her, er en kinesisk lab som binder et gigawatt inferenskapasitet til en innenlandsk komponent den anser god nok til å levere og ennå ikke god nok til å trene på — og som gjør det på en tidsplan lang nok til at programvaregapet rekker å lukkes.

Hva man bør følge med på

Tre ting. Om Huaweis minneforsyning bedrer seg nok til å holde planen for 2027-2028. Om DeepSeeks neste flaggskip trenes på Nvidia-maskinvare, slik denne planen antyder. Og om en kinesisk lab kunngjør en fullstendig treningskjøring på Ascend — det, og ikke en inferensbestilling, ville vært punktet der eksportkontrollenes regnestykke faktisk endres.