CoreWeave meddelade den 30 september, på sin konferens Fully Connected i San Francisco, att bolaget lägger till Nvidias Vera-processor i sitt moln. Nvidia beskriver Vera som den första processorn byggd specifikt för AI-agenter snarare än för allmän databehandling, och CoreWeave är bland de första kommersiella operatörerna som åtar sig att erbjuda den.

Konfigurationen bolagen beskriver är ett rack med 128 Vera-processorer och 11 264 kärnor, som klarar mer än 11 000 samtidiga agentmiljöer. Varje krets bär 88 kärnor, upp till 1,5 TB LPDDR5X-minne med upp till 1,2 TB/s och en NVLink-C2C-länk till en grafikprocessor på upp till 1,8 TB/s.

Den påstådda fördelen ligger i starten, inte i körningen

CoreWeave säger att agentsandlådor startar mer än tre gånger snabbare på Vera än på x86, och uppger upp till 1,8 gånger på kod- och kompileringslaster. Båda siffrorna kommer från leverantörerna och har inte prövats oberoende.

En konferensscen med en stor skärm
Beskedet kom på CoreWeaves konferens Fully Connected. Illustrativ bild. Matheus Bertelli · pexels · Pexels License

Det underliggande argumentet handlar om vad en agentlast faktiskt gör. En agent ägnar mycket av tiden åt att skapa en sandlåda, köra en kort uppgift i den och riva ner den, vilket belastar processkapning, minnesbandbredd och länken till acceleratorn snarare än uthållig enkeltrådsprestanda. Chen Goldberg, produkt- och teknikchef på CoreWeave, formulerade det som att allmän infrastruktur strypar agentbaserad AI, och att Vera är den första processorn uttryckligen byggd för att snabba upp den.

En tekniker som monterar hårdvara i ett rack
Alla prestandasiffror kommer från leverantörerna. Illustrativ bild. Anete Lusina · pexels · Pexels License

Rubin är den del som redan levereras

Separat gick ett Vera Rubin NVL72-kluster över flera rack — 72 Rubin-grafikprocessorer och 36 Vera-processorer per rack — in i begränsad tillgänglighet i CoreWeaves moln den 30 september, med Cognition, bolaget bakom kodagenten Devin, som första kund med produktionslaster på det. Den fristående Vera-tjänsten har varken lanseringsdatum eller publicerade priser.

Vad att bevaka

Om någon publicerar en mätning av sandlådestart på Vera som varken Nvidia eller CoreWeave har kört, och om priset hamnar i närheten av x86-instanser när det väl finns ett.