En større basismodell til gammel pris
SpaceXAI slapp Grok 4.7 mandag og beholdt prisen fra forgjengeren. Inndata koster 2 dollar per million tokens og utdata 6 dollar per million, det samme som Grok 4.6, med en rask variant som leveres med dobbel utmatingshastighet til dobbel pris. Selskapet omtaler den som sin mest kapable modell for koding og kunnskapsarbeid.
Endringene under panseret er strukturelle, ikke kosmetiske. SpaceXAI sier at Grok 4.7 bygger på en ny og større basismodell enn Grok 4.6, trent med en lengre runde forsterkende læring på en vanskeligere oppgavemiks som er vektet mot problemer som tar mange timer. Selskapet sier også at modellen er trent til å forstå Grok Bot-miljøet, dets egen agentplattform, fra grunnen av.
Selskapets tall, og noen andres
SpaceXAIs egen tabell gir Grok 4.7 46,3 prosent på CursorBench 4.0, opp fra 40,4 prosent for Grok 4.6, foran de 41,7 prosentene som oppgis for GPT-5.6 Sol, men bak Claude Fable 5.1 på 51,8 prosent. På EEBench, en elektroteknisk test, oppgis 64,0 prosent mot 39,4 for GPT-5.6 Sol og 56,4 for Fable 5.1. På Harveys juridiske agenttest oppgis 19,6 prosent mot 6,7 for Fable 5.1.

Dette er leverandørens egne tall. Det uavhengige bildet er mindre smigrende. Artificial Analysis, som kjører sine egne evalueringer, ga Grok 4.7 46 på sin Intelligence Index v4.3.2, mot 53 for både Claude Fable 5.1 og GPT-6, ifølge The Decoder.
Forskjellen er tydeligst i én test begge kjørte. SpaceXAI oppgir 38,0 prosent på Terminal-Bench 4.0. Artificial Analysis målte 26 prosent, omtrent der de plasserer DeepSeek V4.1 Flash på 27 prosent, og langt under de 60 prosentene de oppgir for GPT-6 Astra og 55 for Claude Fable 5.1.
Der den faktisk leder
På GDPval, som vurderer profesjonelt arbeid, publiserer SpaceXAI en Elo på 1 695 for Grok 4.7 på den høyeste innsatsinnstillingen, bak Fable 5.1 på 1 735 men foran GPT-6 Astra på 1 542. Selskapet oppgir også 1 657 på AA Briefcase v1.1, like under Fable 5.1s 1 678.

Lest sammen forteller leverandørtabellen og den uavhengige indeksen en sammenhengende historie om posisjonering snarere enn en motsigelse: modellen gjør det bra på flertimers profesjonelt arbeid i dokumentform og dårligere på lange terminaloppgaver, til en pris nærmere kinesiske åpne modeller enn vestlige frontmodeller.
Et nytt lag med sikringer
SpaceXAI sier at Grok 4.7 kommer med et helt nytt lag med sikringer og er den sterkeste modellen selskapet har testet på avslag og motstand mot jailbreak. Det oppgis at modellen topper LatchBios biosikkerhetstest med 62,4 prosent, og at den slipper gjennom 3,3 prosent av risikable dobbeltbruksforespørsler på HackerBench v0.3, selskapets interne cybertest. Begge er selskapets egne målinger.
Selskapet har også begynt å gi utvalgte cybersikkerhetspartnere invitasjonsbasert tilgang til Grok 4.7s red team-evner for forsvarsforskning, en smalere utgave av tilgangsspørsmålet som har delt laboratoriene hele året.
Hva som avgjør fortsettelsen
Modellen er tilgjengelig nå i Cursor og Grok Build, gjennom Grok-API-et og via tredjeparts kodeverktøy, modellrutere og skyplattformer. Spørsmålet er om avviket på Terminal-Bench krymper når flere uavhengige evalueringer kommer, og om 2 dollar per million inndatatokens er nok til å flytte utviklere som i dag betaler 10 for Fable 5.1.