Teknologi

Gemini 4 Argon er Googles comebackmodell – men nesten ingen får bruke den ennå

Google DeepMinds nye modell skriver opptil 1 million tokens og topper Googles egne lister, men går først til godkjente cyberforsvarere
Adrian Kessler
Legg oss til på Google

Gjennom mesteparten av det siste året handlet Googles fortelling om kunstig intelligens om det selskapet ikke hadde lansert. Gemini 4 Argon er svaret, og det mest avslørende ved den er ikke en benchmarkscore. Det er gjestelisten. Google DeepMinds nye frontiermodell går først til en liten gruppe godkjente cybersikkerhetsforsvarere gjennom selskapets Fairwind Program, og til ingen andre.

Argon er bygget for arbeid med lang tidshorisont: programvareutvikling, juridisk og finansiell research og cyberforsvar. Den viktigste mekaniske endringen er utdatalengden: modellen kan nå resonnere og skrive hundretusenvis av tokens i én omgang, nok til å føre en stor kodemigrering helt i mål i stedet for å lappe den sammen av fragmenter.

Google sier at tusenvis av selskapets ingeniører allerede bruker den. I kunngjøringen beskriver selskapet Argon-agenter som har frigjort mer enn 300 TiB minne på tvers av datasentrene og som porterer C- og C++-kode til det minnesikre språket Rust, opp til de over 800 000 linjene i Fuchsia Zircon-kjernen. På libgav1, Googles videodekoder med åpen kildekode, skrev Argon om 32 000 linjer håndoptimalisert SIMD-kode til sikker Rust som kjører 2,7 ganger raskere enn den tidligere Rust-porteringen.

Bar chart comparing Gemini 4 Argon and Gemini 3.8 Flash Cyber on vulnerability discovery and the Wiz penetration test benchmark
Image: Google

Taket for utdata heves til 1 million tokens, fra 64 000. Benchmarktallene er Googles egne: 77,9 % på DeepSWE v1.1, førsteplass på Vals Index for økonomisk vektet kunnskapsarbeid og 91,7 % på LVBench for forståelse av lange videoer. En opptelling fra VentureBeat viser at Argon leder klart på 12 av 18 offentliggjorte benchmarks, mens OpenAIs GPT-6 Astra fortsatt slår den med mer enn ti poeng på FrontierSWE v2. Inntil eksterne testere kan kjøre modellen, er dette påstander, ikke dommer.

Cybersikkerhetsvinklingen forklarer adgangssperren. Google har trent Argon til å finne, validere og tette sårbarheter på egen hånd, og vil gi betrodde forsvarere en versjon der cybersperrene er fjernet. Gjennom Wiz’ initiativ Scan for Good flagget modellen en kritisk feil i sykehusprogramvare som eksponerte personopplysninger, og som tidligere modeller hadde oversett. Den ubehagelige mekanismen er at en modell som er så god til å tette hull, per definisjon også er god til å finne dem.

Derfor er sikkerhetstiltakene den egentlige historien. Google sier at Argon nekter å hjelpe til med cyberangrep og kjemiske, biologiske, radiologiske eller nukleære angrep, er selskapets hittil mest motstandsdyktige modell mot promptinjeksjon og kjører under en overvåker som følger tankekjeden og stanser kjøringen når modellen går ut over brukerens hensikt. Google deltar også i den amerikanske regjeringens frivillige ordning for tilgang til modeller før lansering.

Hvem kan bruke Gemini 4 Argon i dag? Bare Fairwind-gruppen og Googles egne team. Det finnes ingen dato for utviklere, bedrifter eller forbrukere; tilgangen starter med betalende API-kunder og abonnenter på Google AI Ultra. Introduksjonsprisen er 2 dollar per million input-tokens og 10 dollar per million output-tokens, og stiger deretter til henholdsvis 4 og 20 dollar.

Modellen ble kunngjort 30. september av Koray Kavukcuoglu, som overtok toppjobben i Google DeepMind etter at Demis Hassabis gikk av som administrerende direktør i august. Det er Googles første nye flaggskip siden Gemini 3 i november 2025, og den virkelige prøven er ikke en rangering, men om en modell som slippes uten sikkerhetssperrer, blir værende i de hendene den var ment for.

Tagger: , , , , ,

Legg oss til på Google

Diskusjon

Det er 0 kommentarer.