Google släppte Gemini 4 Argon den 30 september, den första modellen i Gemini 4-familjen och företagets första nya flaggskepp sedan Gemini 3-serien kom i november 2025. Nästan ingen kan använda den ännu.
Modellen går först till en sluten grupp som Google kallar Fairwind-programmet — cyberförsvarare som företaget bedömer som betrodda — och till Googles egna interna team. De två grupperna får en version av Argon där cyberskydden är borttagna. Alla andra väntar. Google säger att utvecklare, företag och konsumenter kommer senare, med betalande API-kunder och prenumeranter på Google AI Ultra först, medan bolaget stärker skydden mot cyber- och CBRN-missbruk, indirekt promptinjektion, feljusterade modeller och osäkra agentmiljöer.
Säkerhetspåståendet är nyheten
Google säger att Argon kan hitta en kritisk sårbarhet i programvara, bekräfta att den är verklig och skriva rättningen utan en människa i loopen. Företaget säger också att modellen hittade ett kritiskt fel i vårdprogramvara som används av sjukhus i hela världen och som tidigare frontmodeller missade. Google har inte namngett programvaran och inte publicerat någon sårbarhetsrapport.
Bolaget låter också Argon gå genom den amerikanska regeringens frivilliga process för förhandsåtkomst till modeller, samma ordning som varit omstridd i andra fall den här månaden.
Googles egen testtabell
Google publicerade 18 jämförelser mot GPT-6 Astra och Claude Opus 5.5, och Argon leder eller delar förstaplatsen i 13 av dem. Det är siffror från leverantören själv, inte oberoende resultat.

På DeepSWE v1.1, ett test för mjukvaruutveckling, sätter Google Argon på 77,9 procent mot 74,2 för Opus 5.5. På AutomationBench, som mäter hur affärsuppgifter genomförs, anger bolaget 51,3 procent mot 42,5. På LVBench, ett test för förståelse av lång video, uppger det 91,7 procent. På Harveys utvärdering av juridiska agenter är avståndet det största Google visar: 19,6 procent för Argon mot 5,4 för GPT-6 Astra. På Gray Swans test för indirekt promptinjektion anger Google en framgångsgrad för angrepp på 0,7 procent, mot 8,5 för Astra och 1,0 för Opus 5.5.
Skillnaderna går också åt andra hållet, och Google publicerade dem. Astra leder FrontierSWE v2 med 65,5 procent mot Argons 55,0 och Terminal-Bench Science 0.1 med 68,1 mot 57,6. Opus 5.5 leder Terminal-bench 4.0 med 66,4 mot 57,4.
En miljon tokens ut
Den förändring som troligen betyder mest i praktiken är utmatningsgränsen. Argon kan skriva upp till en miljon tokens i ett enda svar, mot 64 000 i Googles tidigare modeller. För en agent som ska migrera en kodbas eller gå igenom ett långt avtal försvinner behovet av att sy ihop arbetet över flera anrop.

Google säger att tusentals av företagets egna anställda redan använder modellen, och ger tre interna exempel: en optimering inom kvantberäkning som slog publicerade utgångsvärden med 40 procent, minnesoptimeringar som frigjorde mer än 300 TiB i bolagets datacenter, och en omskrivning av SIMD-kod i videoavkodaren libgav1 som går 2,7 gånger snabbare än Rust-versionen.
Vad den kostar
Argon släpps till ett introduktionspris på 2 dollar per miljon tokens in och 10 dollar per miljon ut, med cachad inmatning rabatterad 95 procent till 0,10 dollar. Efter introduktionsperioden stiger priserna till 4 och 20 dollar. Till introduktionspriset ligger Argon under GPT-6 Astra, som Google anger till 10 och 50 dollar, och i nivå med Opus 5.5 när rabatten tar slut.
Vad som är värt att följa
Om Argon blir allmänt tillgänglig före årsskiftet, och om Google berättar vilka som ingår i Fairwind-programmet. En modell som medvetet släpps utan cyberskydd till en namnlös grupp av externa organisationer är en styrningsfråga, inte bara ett produktbeslut, och hittills är det Google som avgör vilka som får vara med.