Hopp til hovedinnhold
 AI-nyheter, ferdig filtrert for ledere
SISTE:

Dommer river Pentagons Anthropic-svartelisting – kaller den grunnløs • Alabama stevner OpenAI etter agentinnbruddet i Hugging Face • Bloomberg: NVIDIA-kunder varsles om over 15 prosent prishopp på AI-servere • OpenAI kutter GPT-5.6 Sol mer enn 20 prosent – i tre måneder

Google slipper Gemini 3.8 Flash: GA i dag – Cyber bak Fairwind
AI-modellerGoogleGeminiGemini 3.8 FlashFairwindCybersikkerhetAI-agenterKodingCIOCISOFinOps

Google slipper Gemini 3.8 Flash: GA i dag – Cyber bak Fairwind

JH
Joachim Høgby
2. september 20262. september 20266 min lesingKilde: Google

Google har sluppet to modeller samme dag. Gemini 3.8 Flash er allment tilgjengelig. Gemini 3.8 Flash Cyber er det ikke. Den går til et stengt Fairwind-program for myndigheter, kritisk infrastruktur og utvalgte sikkerhetspartnere.

Det er tredje Flash-slipp på seks uker, tre uker etter 3.7 Flash. Google kaller 3.8 «our best reasoning & coding model yet» til samme fart og intropris som 3.7. For CIO og CISO er det tre beslutninger, ikke en demo: om 3.8 Flash skal inn som default i agentflyter, om tenkenivået skal styres hardt, og om Flash Cyber i det hele tatt er noe dere kan, eller bør, søke om.

Hva som faktisk er lansert

Modell-ID er gemini-3.8-flash. Den er GA i Gemini API, Google AI Studio, Gemini Enterprise Agent Platform og Google Antigravity. Den er nå standardmotor i Googles Managed Agents, inkludert Antigravity-agenten og Antigravity SDK. Google AI Pro- og Ultra-abonnenter får den i Gemini-appen, AI Mode i Search og Gemini i Sheets.

Det er ikke en ny Pro. Det er neste workhorse i Flash-rekken. Inn: tekst, bilde, video, lyd og PDF. Ut: tekst. Kontekstvindu 1 048 576 tokens. Maks ut 65 536 tokens ifølge API-dokumentasjonen. Tenkenivåene er low, medium og high. Standard er medium. minimal er ikke støttet og gir feil.

Verktøystakken er Flash-pakken: caching, kodekjøring, funksjonskall, fil-søk, søke- og kart-grounding, URL-kontekst og strukturert utdata. Computer use er i preview. Live API, bildegenerering og lydgenerering er ikke støttet.

Google hevder tre evneløft mot 3.7 Flash: bedre treff på lange kodejobber og flerfil-refaktorering, mer robust flertrinns orkestrering med færre feilede løkker, og høyere faktarigør i tunge domeneflyter. På DeepSWE v1.1 sier Google at 3.8 Flash slår de fleste større frontiermodeller ende-til-ende, til en brøkdel av prisen. På Vals Finance Agent V2 og Harveys Legal Agent Benchmark hevder de samme mønster. Offisielt tall på HLE-Verified er 54,9 prosent. Vi tar SOTA-påstandene som leverandørkrav, ikke som uavhengig fasit.

Forklaringen Google selv gir: 3.8 Flash jobber hardere. På komplekse oppgaver tar den flere, mindre resonneringssteg, kaller verktøy iterativt og sjekker arbeidet underveis. «At times, the model might use more tokens to maximize performance, especially at higher effort levels.» Hvis kostnad er den harde rammen, sier Google at du skal senke tenkenivå eller bli på 3.7 Flash. 3.7 Flash forblir støttet.

Prisen er en innkjøpsklausul

Introprisen er 0,75 dollar per million input-tokens og 3,75 dollar per million output-tokens ut 31. desember 2026. Samme intropris som 3.7 Flash. Fra 1. januar 2027 blir standard 1,50 / 7,50 dollar. Det er dobling, ikke justering.

For leder er det fire måneder, ikke «Flash er billig». Agentflyter med medium eller high, verktøykall og egen verifisering driver output. Bedre førstetreff kan likevel gi høyere tokenregning hvis du ikke styrer thinking_level. medium er Googles anbefaling for kode og agenter. low hører hjemme i varslingsløyper og chat. high skal ha eier og tak.

Batch, flex og priority inference er støttet. Provisioned throughput ligger i Enterprise Agent Platform. Det er der du låser kapasitet før agenter treffer produksjonskøer.

Migrering er mer enn å bytte modellstreng. Google ber deg fjerne temperature, top_p og top_k. thinking_budget erstattes av thinking_level. candidate_count er borte. Hvis agenten har levd på sampling-triks, kan 3.8 Flash oppføre seg annerledes enn 3.7 ved samme prompt.

Flash Cyber: åpen modell, stengt kapabilitet

3.8 Flash Cyber er Googles «most capable cybersecurity model» for sårbarhetsfunn og automatisk patching. Den er ikke i API-et du kan kalle i dag. Tilgang går gjennom Fairwind, et begrenset program for Google Cloud-kunder, nasjonale cybermyndigheter og sikkerhetspartnere. Google sier over 650 partnere globalt er med. Deltakere skal begrense tilgang til interne cyber-, IR- og pentest-team og kreve flerfaktor.

Fairwind kobler 3.8 Flash Cyber til CodeMender-harnessen. Budskapet er funn, verifikasjon og fiks i eget sikkert skymiljø, ikke et åpent offensivt verktøy. Google sier de har prioritert sårbarhetsfiksing foran utnyttelse.

Tallene er Googles egne. På CyberGym hevder de frontier-nivå i autonom sårbarhetsoppdagelse, foran 3.5 Flash Cyber og vesentlig større modeller. På en intern test over 20 språk sier de suksessrate over 70 prosent. På CWE-Bench (Collinear) er pass@1 47,2 prosent mot 47,8 prosent for en ledende frontiermodell, til vesentlig lavere kostnad. Chrome-sikkerhetsteamet skal ha fått 2,6 ganger flere korrekte patcher enn de beste, langt større kommersielle modellene. Wiz rapporterer 7,5–9,7 prosentpoeng høyere recall på intern pentest, til 2,3–5,2 ganger lavere kostnad. Cloud Vulnerability Research skal ha funnet en kritisk sårbarhet på under to timer.

3.8 Flash Cyber har mer permissive mitigeringer for cyber enn den åpne 3.8 Flash. Derfor er den stengt. CISO-spørsmålet er ikke om Google kan finne bugs i Chrome. Det er hvem som får den mer permissive varianten, under hvilken avtale, og hva som skjer når samme evne lekker eller kopieres utenfor Fairwind.

Sikkerhet og styring

Modellkortet, datert 2. september 2026, plasserer 3.8 Flash i Gemini 3-familien. Google DeepMind vurderte 3.7 Flash mot Frontier Safety Framework fra april 2026 og fant ingen Tracked eller Critical Capability Levels. De skriver at 3.8 Flash ikke har meningsfulle nye evner i de samme domenene, og derfor heller ikke treffer T/CCL. Det er en arvet konklusjon, ikke en ny, selvstendig grensevurdering av 3.8.

Automatiserte sikkerhetstall mot 3.7 Flash er blandet. Tekstsikkerhet er 0,4 prosentpoeng bedre. Bilde-til-tekst uendret. Flerspråklig sikkerhet er 5,4 prosentpoeng dårligere. Ubegrunnede avvisninger er 1,1 prosentpoeng høyere. Tone er 0,2 prosentpoeng bedre. Google sier manuell gjennomgang fant at tapene i hovedsak var falske positiver eller ikke grove. CISO bør likevel be om språkdekning og refusjonsrate på egne data.

3.8 Flash har sikringer mot misbruk i CBRN og cyberoffensiv, ifølge Frontier Safety Framework. Google hevder også et hopp i robusthet mot prompt injection, målt av Gray Swan. Kunnskapsgrensen er splittet: enkelte domener til mars 2026, andre til januar 2025. Det treffer agenter som skal sitere ferske regler, avtaler eller CVE-er.

Hva dette betyr for ledere

Sett 3.8 Flash i test mot de faktiske jobbene, ikke mot en blogg. Relevante tester er lange refaktoreringer, agentløkker med verktøy, og flyter der førstetreff koster mer enn latency. Mål tokens, ikke bare kvalitet. high kan vinne eval og tape budsjett.

Ikke rull den inn som default uten tenkenivå-policy. Behold 3.7 Flash som kontrollarm til du har egne tall. Google åpner selv for det.

Prisdoblingen 1. januar 2027 må inn i prognosen nå. Hvis Managed Agents i Antigravity allerede peker på 3.8 Flash, har Google valgt for deg. Da er spørsmålet observabilitet, datahåndtering og exit.

Flash Cyber er et tilgangs- og styringsspørsmål, ikke en modelldemo. Hvis dere er i målgruppen for Fairwind, krev avtale, logging, menneske i loopen på patch, og forbud mot å bruke den mer permissive varianten utenfor IR og pentest. Hvis dere ikke er i målgruppen: anta at motstandere vil jakte tilsvarende evne annetsteds. Patchvinduet krymper uansett.

Fable 5.1 kom dagen før. Sammenlign på deres oppgaver, ikke på leverandørslides.

Kilder og medier

Primærkilde: Google, «Introducing Gemini 3.8 Flash and 3.8 Flash Cyber», https://blog.google/innovation-and-ai/models-and-research/gemini-models/3-8-flash-and-3-8-flash-cyber/

Google, Gemini 3.8 Flash-modelsiden, https://ai.google.dev/gemini-api/docs/models/gemini-3.8-flash

Google, «What's new in Gemini 3.8 Flash», https://ai.google.dev/gemini-api/docs/latest-model

Google DeepMind, modellkort for Gemini 3.8 Flash, https://deepmind.google/models/model-cards/gemini-3-8-flash/

Google, Fairwind-programmet, https://blog.google/innovation-and-ai/technology/safety-security/fairwind-program/

Thumbnail: OpenAI Image 2 / hogby.ai

📬 Likte du denne?

AI-nyheter for ledere. Kuratert av en CIO som bygger det selv. Daglig i innboksen.