Hopp til hovedinnhold
 AI-nyheter, ferdig filtrert for ledere
SISTE:

OpenAI dots: Astra 24/7 – Pro stengt i EØS, 4000 apper • AISI: Astra 29 prosent – falsk identitet, payload utenfor scope • OpenAI-agenter: 16 500 UNCTAD-skann – XSS-spill, 82 rate-limits • OpenAI: DNS-hull – pause i trening av de mest kapable • OpenAI-agenter la ut 53 brukerbilder – kan ikke varsle ofrene

Gemini 4 Argon: 1M ut-tokens, 2/10 dollar, cyber først
GoogleGeminiCIOCISOAI-modellerCybersikkerhetAgenterFinOps

Gemini 4 Argon: 1M ut-tokens, 2/10 dollar, cyber først

JH
Joachim Høgby
30. september 202630. september 20266 min lesingKilde: Google

Google DeepMind lanserer Gemini 4 Argon 30. september 2026. Det er labens første Gemini 4-flaggskip, og første frontier-modell over Flash-linjen på over sju måneder. Koray Kavukcuoglu, SVP i DeepMind og Googles chief AI architect, posisjonerer den mot lange, flertrinns arbeidsflyter i programvareutvikling, juss og finans, og cyberforsvar. Output-taket er 1 million tokens, opp fra 64 000. Innledende API-pris er 2 dollar per million inn-tokens og 10 dollar per million ut, med 95 prosent rabatt på cache-inn. Etter introduksjonsperioden blir listen 4/20. Allmenn tilgang kommer ikke nå. Først ut er Fairwind-programmet for betrodde cyberforsvarere, pluss USAs frivillige pre-release-løp for myndigheter.

For CIO er dette et signal om at Google er tilbake i frontier-laget, med innkjøringspris under Opus 5.5. For CISO er det viktigere at Google slipper Argon uten cyber-rekkverk til utvalgte forsvarere, og at modellen skal kunne finne, validere og patche sårbarheter autonomt.

Hva Google faktisk lanserer

Argon er ikke en Flash-oppdatering. Google droppet Gemini 3.5 Pro tidligere i år. 3.8 Flash og 3.8 Flash Cyber har båret linjen. Argon er neste generasjon, bygget for lange løp der modellen skal tenke og skrive i samme bane. Når den har rom til hundretusenvis av ut-tokens i ett trekk, er poenget dybde på én oppgave, ikke chat-snutt.

Labens egne tall, publisert på DeepMind-sidene, gir Argon 77,9 prosent på DeepSWE v1.1, som måler langtids programvarearbeid. Claude Opus 5.5 ligger på 74,2 og GPT-6 Astra på 74,1. På Vals Index, som vekter finans, koding, juss og skatt etter USAs BNP, leder Argon med 68,9 prosent mot 67,0 for Opus 5.5 og 63,1 for Astra. Harveys Legal Agent Benchmark er 19,6 prosent mot 6,7 for Claude Fable 5.1 og 5,4 for Astra. AutomationBench fra Zapier, ende-til-ende forretningsflyt, er 51,3 prosent. LVBench for lang video er 91,7 prosent. Vals Finance Agent v2 er 65,4 prosent.

Google sier Argon leder rent på 12 av 18 sammenligninger i deres sett og deler førsteplass på én. Det er labens tabell, ikke et uavhengig lederboard. Der Google taper, taper de på steder ledere merker i produksjon: FrontierSWE v2 55,0 mot Astras 65,5, Terminal-bench 4.0 57,4 mot Opus 66,4, OSWorld-2.0 69,2 mot Astras 72,6, og Terminal-Bench Science 0.1 57,6 mot Astras 68,1. PostTrainBench går til Opus. CWE-bench v1 er uavgjort med Astra på 68 prosent.

Internt hos Google brukes Argon allerede. Labens eksempler: 40 prosent bedre enn publisert baseline på en kvante-subrutine, på minutter. En agentflokk som gikk gjennom flåte-telemetri og frigjorde over 300 TiB minne, med estimat 500 TiB til 1 PiB. Rust-migrering av C/C++ i re2, libgav1 og over 800 000 linjer i Fuchsia Zircon-kjernen, med automatisert og manuell revisjon og emulering før produksjon. For libgav1 skal agenter ha erstattet 32 000 linjer SIMD i en Rust-port og fått en minnesikker dekoder 2,7 ganger raskere enn den forrige Rust-porten, med identisk video. Det er Googles egne caser. De er ikke tredjepartsrevisjon.

Pris, cache og hvem som får den

Intropris 2/10. Cache-inn 95 prosent under inn-pris, altså 0,10 dollar per million. Etter introduksjonsperioden: 4 dollar inn og 20 dollar ut. Opus 5.5 ligger på 4/20 i dag. Google subsidierer innkjøringen. For agentløp med gjenbrukt kontekst er cache-linjen den reelle kostnaden, ikke listprisen. 1 million ut-tokens til 10 dollar per million blir dyrt hvis modellen tenker høyt gjennom hele migreringen. Budsjetter per ferdig oppgave, ikke per chat.

Tilgang: Fairwind først. Google er i USAs frivillige pre-release-løp for myndigheter. Deretter utviklere, virksomheter og forbrukere «så snart som mulig», startende med betalende API-kunder og Google AI Ultra. Ars Technica og VentureBeat bekrefter at du ikke kan bruke den allment ennå. SiliconANGLE skriver at Fairwind åpnet 3. september med 3.8 Flash Cyber og har over 650 organisasjoner, blant dem CrowdStrike og Palo Alto Networks. Det er sekundærkilde, ikke Googles tall.

Fairwind-vilkårene på DeepMinds sider er harde: brukernivå-autentisering, phishing-resistent MFA, tilgang bare til interne cyber-, IR- eller pentest-team, og sporbar bruk. Zero data retention er tilgjengelig når Argon kjøres som managed modell i Gemini Enterprise. Det er ikke en sandkasse for produktteam.

Cyber først, uten rekkverk for de utvalgte

Google har trent Argon for forsvar: finne, validere og patche sårbarheter. Til betrodde forsvarere og interne team slippes den uten cyber-rekkverk, slik at full forsvarskapasitet kan brukes. Det er et CISO-punkt, ikke en fotnote. Dual-use er åpenbar. Google sier de styrker avvisning av skadelige forespørsler, inkludert CBRN, overvåker interne aktiveringer, og har rødt-teamet både internt og eksternt.

Wiz bruker Argon i Scan for Good. Google hevder modellen fant en kritisk sårbarhet i helsesoftware brukt av sykehus globalt, som tidligere frontier-modeller skal ha misset. Det er Googles eksempel, ikke en uavhengig rapport du kan styre etter.

Mot indirekte prompt-injeksjon kaller Google Argon sin mest robuste modell og viser til Gray Swans IPI-benchmark. Misalignment-overvåking skal stoppe kjeden når tankerekke eller handling går utenfor brukerens intensjon. Treningskjøringer overvåkes av et eget incident-team, uten å mate funnene tilbake i treningen. Sandkasser isoleres og forsegles før høyrisiko-trening og eval, i tråd med labens agent control-roadmap.

Poenget for norske styrer: evnen er der, tilgangen er gated, og Google innrømmer at de trenger mer guardrail-iterasjon før bred utrulling. Dette er ikke en ChatGPT-erstatning i morgen, og det er ikke en modell du slipper løs i produksjon uten logging og stoppkriterier.

Hva ledelsen bør gjøre nå

Ikke bytt plattform på en modell du ikke har i API ennå. Gjør tre ting.

Kartlegg om dere er i Fairwind-målgruppen: nasjonal CERT, MSSP, interne red team. Hvis ja, søknad og vilkår må opp til CISO, ikke innovasjonsteamet. MFA, tilgangsstyring og sporbarhet er inngangsbillett, ikke etterarbeid.

Sett Argon inn i leverandørkortet mot GPT-6 Astra, GPT-6.1 Sol og Opus 5.5. Sol er billig arbeidshest i ChatGPT Work og Codex i dag. Argon er Googles forsøk på å ta tilbake frontier på koding, juss/finans og cyber, til 2/10 i en periode. Når 4/20 slår inn, er prisfordelen mot Opus borte. Da gjenstår evne, datahåndtering og om Google faktisk åpner API.

Krev egne evals på deres repos og deres IR-runbooks. Googles DeepSWE-ledelse sier lite om deres COBOL, SAP-integrasjoner eller norske regelverk. Der Argon taper i labens egen tabell, er det nettopp terminal, computer use og visse SWE-sett. Det er der agentene møter virkeligheten.

1 million ut-tokens betyr at én bane kan bære en hel migrering eller en lang pentest-rapport. Det øker både nytte og blast radius. Logging, human-in-the-loop og stoppkriterier må på plass før noen skrur av rekkverkene. Fairwind uten cyber-rekkverk er et bevisst valg fra Google. Det er ikke default for resten av virksomheten.

Kilder og medier

Primærkilde: Google, «Gemini 4 Argon: our next era of frontier intelligence», 30. september 2026: https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-4-argon/

Benchmark-tabell: Google DeepMind, Gemini 4 Argon: https://deepmind.google/models/gemini/

Fairwind-programmet: Google DeepMind, https://deepmind.google/fairwind-program/

Sekundærkilder: Ars Technica, VentureBeat og SiliconANGLE bekrefter begrenset utrulling, intropris og at allmenn tilgang mangler.

Thumbnail: OpenAI Image 2 / hogby.ai

📬 Likte du denne?

AI-nyheter for ledere. Kuratert av en CIO som bygger det selv. Daglig i innboksen.