Teknologi

Gemini 4 Argon er Googles comebackmodel – men næsten ingen kan bruge den endnu

Google DeepMinds nye model skriver op til 1 mio. tokens og topper Googles egne lister, men går først til godkendte cyberforsvarere
Adrian Kessler
Tilføj os på Google

I det meste af det seneste år handlede Googles historie om kunstig intelligens om det, selskabet ikke havde lanceret. Gemini 4 Argon er svaret, og det mest afslørende ved den er ikke en benchmarkscore. Det er gæstelisten. Google DeepMinds nye frontiermodel går først til en lille gruppe godkendte cybersikkerhedsforsvarere gennem selskabets Fairwind Program, og til ingen andre.

Argon er bygget til arbejde med lang tidshorisont: softwareudvikling, juridisk og finansiel research samt cyberforsvar. Den vigtigste mekaniske ændring er outputlængden: modellen kan nu ræsonnere og skrive hundredtusindvis af tokens i ét gennemløb, nok til at føre en stor kodemigrering helt til ende i stedet for at stykke den sammen af fragmenter.

Google siger, at tusindvis af selskabets ingeniører allerede bruger den. I annonceringen beskriver selskabet Argon-agenter, der har frigjort mere end 300 TiB hukommelse på tværs af dets datacentre og porterer C- og C++-kode til det hukommelsessikre sprog Rust, op til de mere end 800.000 linjer i Fuchsia Zircon-kernen. På libgav1, Googles open source-videodekoder, omskrev Argon 32.000 linjer håndoptimeret SIMD-kode til sikker Rust, der kører 2,7 gange hurtigere end den tidligere Rust-portering.

Bar chart comparing Gemini 4 Argon and Gemini 3.8 Flash Cyber on vulnerability discovery and the Wiz penetration test benchmark
Image: Google

Loftet for output hæves til 1 million tokens fra 64.000. Benchmarktallene er Googles egne: 77,9 % på DeepSWE v1.1, førstepladsen på Vals Index for økonomisk vægtet videnarbejde og 91,7 % på LVBench for forståelse af lange videoer. En optælling fra VentureBeat viser, at Argon fører klart på 12 af 18 offentliggjorte benchmarks, mens OpenAIs GPT-6 Astra stadig slår den med mere end ti point på FrontierSWE v2. Indtil eksterne testere kan køre modellen, er det påstande, ikke domme.

Cybersikkerhedsvinklen forklarer adgangsbegrænsningen. Google har trænet Argon til selv at finde, validere og lappe sårbarheder og vil give betroede forsvarere en version, hvor cyberværnene er fjernet. Gennem Wiz’ initiativ Scan for Good markerede modellen en kritisk fejl i hospitalssoftware, der eksponerede persondata, og som tidligere modeller havde overset. Den ubehagelige mekanisme er, at en model, der er så god til at lukke huller, per definition også er god til at finde dem.

Derfor er sikkerhedsforanstaltningerne den egentlige historie. Google siger, at Argon afviser at hjælpe med cyberangreb og kemiske, biologiske, radiologiske eller nukleare angreb, er selskabets hidtil mest modstandsdygtige model over for prompt injection og kører under en overvåger, der følger dens tankekæde og stopper udførelsen, når den går ud over brugerens hensigt. Google deltager også i den amerikanske regerings frivillige proces for adgang til modeller før lancering.

Hvem kan bruge Gemini 4 Argon i dag? Kun Fairwind-gruppen og Googles egne teams. Der er ingen dato for udviklere, virksomheder eller forbrugere; adgangen begynder med betalende API-kunder og abonnenter på Google AI Ultra. Introduktionsprisen er 2 dollar pr. million input-tokens og 10 dollar pr. million output-tokens, stigende til henholdsvis 4 og 20 dollar bagefter.

Modellen blev præsenteret den 30. september af Koray Kavukcuoglu, der overtog topposten hos Google DeepMind, efter at Demis Hassabis trådte tilbage som administrerende direktør i august. Det er Googles første nye flagskib siden Gemini 3 i november 2025, og den egentlige prøve er ikke en rangliste, men om en model, der frigives uden sikkerhedsværn, forbliver i de hænder, den var tiltænkt.

Tags: , , , , ,

Tilføj os på Google

Debat

Der er 0 kommentarer.