Google slapp Gemini 4 Argon 30. september, den første modellen i Gemini 4-familien og selskapets første nye flaggskip siden Gemini 3-serien kom i november 2025. Nesten ingen kan bruke den ennå.

Modellen går først til en lukket gruppe Google kaller Fairwind-programmet — cyberforsvarere selskapet regner som betrodde — og til Googles egne interne team. De to gruppene får en versjon av Argon der cybervernet er fjernet. Alle andre venter. Google sier utviklere, bedrifter og forbrukere kommer senere, med betalende API-kunder og abonnenter på Google AI Ultra først, mens selskapet styrker vernet mot cyber- og CBRN-misbruk, indirekte promptinjeksjon, feiljusterte modeller og usikre agentmiljøer.

Sikkerhetspåstanden er nyheten

Google sier Argon kan finne en kritisk sårbarhet i programvare, bekrefte at den er reell og skrive rettelsen uten et menneske i løkka. Selskapet sier også at modellen fant en kritisk feil i helseprogramvare som brukes av sykehus over hele verden, og som tidligere frontmodeller overså. Google har ikke navngitt programvaren og ikke publisert noen sårbarhetsvarsel.

Selskapet lar også Argon gå gjennom den amerikanske regjeringens frivillige ordning for tilgang før slipp, den samme ordningen som har vært omstridt i andre saker denne måneden.

Googles egen testtabell

Google publiserte 18 sammenligninger mot GPT-6 Astra og Claude Opus 5.5, og Argon leder eller deler førsteplassen i 13 av dem. Dette er tall fra leverandøren selv, ikke uavhengige resultater.

Et nettverkspanel med fargede ethernetkabler
Den første gruppen som får Argon er en lukket krets av cyberforsvarere. Illustrasjonsfoto. Brett Sayles · pexels · Pexels License

På DeepSWE v1.1, en test for programvareutvikling, setter Google Argon på 77,9 prosent mot 74,2 for Opus 5.5. På AutomationBench, som måler gjennomføring av forretningsoppgaver, oppgir selskapet 51,3 prosent mot 42,5. På LVBench, en test for forståelse av lang video, hevder det 91,7 prosent. På Harveys evaluering av juridiske agenter er avstanden den største Google viser: 19,6 prosent for Argon mot 5,4 for GPT-6 Astra. På Gray Swans test for indirekte promptinjeksjon oppgir Google en angrepssuksess på 0,7 prosent, mot 8,5 for Astra og 1,0 for Opus 5.5.

Forskjellene går også andre veien, og Google publiserte dem. Astra leder FrontierSWE v2 med 65,5 prosent mot Argons 55,0 og Terminal-Bench Science 0.1 med 68,1 mot 57,6. Opus 5.5 leder Terminal-bench 4.0 med 66,4 mot 57,4.

En million tokens ut

Endringen som sannsynligvis betyr mest i praksis er grensen for utdata. Argon kan skrive opptil en million tokens i ett enkelt svar, mot 64 000 i Googles tidligere modeller. For en agent som skal migrere en kodebase eller gå gjennom en lang kontrakt, forsvinner behovet for å sy sammen arbeidet over flere kall.

En tom hvit korridor kantet av dører
Google sier Argon fant en kritisk feil i helseprogramvare som brukes av sykehus over hele verden. Illustrasjonsfoto. Enrique Silva · pexels · Pexels License

Google sier tusenvis av selskapets egne ansatte allerede bruker modellen, og gir tre interne eksempler: en optimalisering innen kvanteberegning som slo publiserte referanseverdier med 40 prosent, minneoptimaliseringer som frigjorde mer enn 300 TiB i datasentrene, og en omskriving av SIMD-kode i videodekoderen libgav1 som går 2,7 ganger raskere enn Rust-versjonen.

Hva den koster

Argon slippes til en introduksjonspris på 2 dollar per million tokens inn og 10 dollar per million ut, med hurtiglagret inndata rabattert 95 prosent til 0,10 dollar. Etter introduksjonsperioden stiger prisene til 4 og 20 dollar. Til introduksjonspris ligger Argon under GPT-6 Astra, som Google oppgir til 10 og 50 dollar, og på nivå med Opus 5.5 når rabatten tar slutt.

Hva som er verdt å følge

Om Argon blir allment tilgjengelig før årsskiftet, og om Google sier hvem som er med i Fairwind-programmet. En modell som bevisst slippes uten cybervern til en navnløs gruppe eksterne organisasjoner er et styringsspørsmål, ikke bare en produktbeslutning, og foreløpig er det Google som avgjør hvem som får være med.