En försening som skylls på belöningen
Grok 4.7 släpps inte än. Elon Musk skrev i ett svar på X den 11 september att modellen “behöver några dagar till i ugnen” och gav ett ovanligt tekniskt skäl: SpaceXAI, företaget bakom Grok, kan ha straffat svarslängd för hårt under förstärkningsinlärningen.
Resultatet är enligt Musk en modell som fortfarande ger upp för tidigt på svåra uppgifter som den faktiskt klarar, och som ännu inte är tillräckligt noggrann när den kontrollerar sitt eget arbete. Musk reserverade sig själv genom att lägga till “eller något” efter förklaringen om längden, och han angav inget nytt lanseringsdatum. TeslaNorth noterade att Musk beskrev förseningen som ett justeringsproblem snarare än en saknad funktion eller en hårdvarubegränsning; även Data Studios rapporterade om förseningen.
Ett datum som flyttats förut
Musk har gett offentliga tidsramar för modellen sedan juli. Enligt en sammanställning av hans inlägg från CellCog skrev han den 24 juli att Grok 4.7 låg fyra veckor bort, den 12 augusti att den borde vara klar om tre till fyra veckor och i början av september att den skulle komma “om 10 dagar”. Det sista inlägget, publicerat tidigt på morgonen den 2 september svensk tid, pekade mot en lansering omkring den 12 september, vilket Big Hat Group och NextBigFuture rapporterade.
Musk har också beskrivit Grok 4.7 som en modell med 2,1 biljoner parametrar och sagt, enligt NextBigFuture, att den skulle vara bättre än Grok 4.6 på allt utom hastighet vid körning, med bättre tokeneffektivitet. Inget av det kommer från företaget självt: SpaceXAI:s versionsanteckningar för utvecklare innehåller ingen post, inget modell-id och inget pris för Grok 4.7.
Vad SpaceXAI senast släppte
Den aktuella modellen är Grok 4.6, som släpptes den 12 augusti. Enligt SpaceXAI bygger den på Grok 4.5, som kom i juli, med särskilt fokus på långvariga agenter. Versionsanteckningarna anger ett kontextfönster på 500 000 token och ett pris på 2 dollar per miljon inmatade token, 0,50 dollar för cachad inmatning och 6 dollar för utdata.
Långvariga agenter är också vad företaget säljer till näringslivet. Den 3 september öppnade det Grok Bot för företag, med kontroller för åtkomst, nätverk och granskning, och erbjöd kunder med Grok och Cursor Enterprise två veckors gratis användning för hela organisationen. En modell som ger upp svårt arbete i förtid är just det fel som det erbjudandet inte har råd med.

Vad ett straff för längd ska göra
Resonerande modeller presterar bättre på svåra problem när de genererar fler token, och den mångordigheten slösar beräkningskraft på enkla problem. Ett etablerat botemedel är att lägga till ett längdstraff i belöningen vid förstärkningsinlärning, så att modellen lär sig svara kortare.
Forskningen visar hur det kan slå fel. En artikel från maj 2025 om stabil förstärkningsinlärning för effektivt resonerande fann att belöningar med längdstraff kan få träffsäkerheten att rasa när svaren blir kortare. Dess metod, GRPO-λ, slopar straffet när modellens svar på en fråga mestadels är fel och behåller det när de mestadels är rätt.
En artikel från juni 2025, Just Enough Thinking, argumenterar mot enhetliga straff som behandlar alla problem lika. Dess adaptiva straff skalar omvänt mot hur ofta modellen löser en uppgift, så att enkla uppgifter får betala dyrt för extra token medan svåra lämnas ifred. På en modell med 1,5 miljarder parametrar rapporterade forskarna att den genomsnittliga tokenanvändningen halverades utan någon betydande försämring av prestandan.

Varför förklaringen spelar roll
Musks beskrivning stämmer väl med det felmönstret. En modell som får betala för varje token har skäl att sluta innan ett svårt problem är löst, och att kontrollera ett svar kostar också token. Varken Musk eller SpaceXAI har sagt vilket straff som användes eller hur det ska ändras, så detta är en informell diagnos snarare än en teknisk redovisning.
Den är ändå konkret. Den pekar på ett val i belöningsdesignen som väger inferenskostnad mot uthållighet, samma avvägning som forskningen om effektivt resonerande har arbetat med sedan åtminstone 2025.
Vad som är värt att bevaka
Nästa konkreta tecken är en post om Grok 4.7 i SpaceXAI:s versionsanteckningar, med modell-id, pris och kontextfönster. Om längdstraffet var problemet syns det i hur modellens tokenanvändning på svåra uppgifter står sig mot Grok 4.6, och i om SpaceXAI:s egna benchmarksiffror, när de kommer, håller i oberoende tester.