En større basismodel til den gamle pris
SpaceXAI udsendte Grok 4.7 mandag og bevarede forgængerens pris. Input koster 2 dollar per million tokens og output 6 dollar per million, det samme som Grok 4.6, med en hurtig variant, der leveres med dobbelt outputhastighed til dobbelt pris. Virksomheden beskriver den som sin mest kapable model til kodning og videnarbejde.
Ændringerne under motorhjelmen er strukturelle og ikke kosmetiske. SpaceXAI siger, at Grok 4.7 bygger på en ny og større basismodel end Grok 4.6, trænet med en længere runde forstærkende læring på et sværere opgavemiks, der er vægtet mod problemer, som tager mange timer. Virksomheden siger også, at modellen er trænet til at forstå Grok Bot-miljøet, dens egen agentplatform, fra bunden.
Virksomhedens tal, og andres
SpaceXAI’s egen tabel giver Grok 4.7 46,3 procent på CursorBench 4.0, op fra 40,4 procent for Grok 4.6, foran de 41,7 procent, der angives for GPT-5.6 Sol, men efter Claude Fable 5.1 på 51,8 procent. På EEBench, en elektroteknisk test, angives 64,0 procent mod 39,4 for GPT-5.6 Sol og 56,4 for Fable 5.1. På Harveys juridiske agenttest angives 19,6 procent mod 6,7 for Fable 5.1.

Det er leverandørens egne tal. Det uafhængige billede er mindre flatterende. Artificial Analysis, som kører sine egne evalueringer, gav Grok 4.7 46 på sit Intelligence Index v4.3.2 mod 53 for både Claude Fable 5.1 og GPT-6, ifølge The Decoder.
Forskellen er tydeligst i én test, begge kørte. SpaceXAI angiver 38,0 procent på Terminal-Bench 4.0. Artificial Analysis målte 26 procent, omtrent der hvor de placerer DeepSeek V4.1 Flash på 27 procent, og langt under de 60 procent, de angiver for GPT-6 Astra, og 55 for Claude Fable 5.1.
Hvor den faktisk fører
På GDPval, der bedømmer professionelt arbejde, offentliggør SpaceXAI en Elo på 1.695 for Grok 4.7 ved den højeste indsatsindstilling, efter Fable 5.1 på 1.735 men foran GPT-6 Astra på 1.542. Virksomheden angiver også 1.657 på AA Briefcase v1.1, lige under Fable 5.1’s 1.678.

Læst sammen fortæller leverandørtabellen og det uafhængige indeks en sammenhængende historie om positionering snarere end en modsigelse: modellen klarer flertimers professionelt arbejde i dokumentform godt og lange terminalopgaver dårligere, til en pris tættere på kinesiske modeller med åbne vægte end på vestlige frontmodeller.
Et nyt lag af værn
SpaceXAI siger, at Grok 4.7 kommer med et helt nyt lag af værn og er den stærkeste model, virksomheden har testet på afvisninger og modstand mod jailbreak. Den angiver at toppe LatchBios biosikkerhedstest med 62,4 procent og at modellen slipper 3,3 procent af risikable dobbeltanvendelsesprompter igennem på HackerBench v0.3, virksomhedens interne cybertest. Begge dele er virksomhedens egne målinger.
Den er også begyndt at give udvalgte cybersikkerhedspartnere adgang efter invitation til Grok 4.7’s red team-evner til forsvarsforskning, en smallere udgave af det adgangsspørgsmål, der har delt laboratorierne hele året.
Hvad der afgør fortsættelsen
Modellen er tilgængelig nu i Cursor og Grok Build, gennem Grok-API’et og via tredjeparts kodeværktøjer, modelroutere og cloudplatforme. Spørgsmålet er, om afvigelsen på Terminal-Bench indsnævres, efterhånden som flere uafhængige evalueringer lander, og om 2 dollar per million inputtokens er nok til at flytte udviklere, der i dag betaler 10 for Fable 5.1.