Google gjør Omni 1.1 Flash produksjonsklar: 4K-video og 40 sekunders scener
Google gjør videomodellen til en API-linje
Google DeepMind har 27. august 2026 gjort Gemini Omni 1.1 Flash til stabil modell i Gemini API. Labben kaller det produksjonsklart: mer styring, raskere iterasjon, og utgang i 1080p og 4K. Dette er ikke et nytt språkflaggskip. Det er en oppdatering av Googles generative videomodell, med modellkort oppdatert samme dag.
For en CIO er poenget enkelt. Video-AI går fra demo til linje i Google AI Studio, Gemini Enterprise Agent Platform, Flow og Gemini-appen. Adobe Firefly, Figma Weave, GMI Cloud og Runway er allerede inne som produksjonskunder. Da er spørsmålet ikke om den kan lage et pent klipp, men kostnad, provenance, merkevarekontroll og hva som skjer når en intern agent forlenger en scene uten at et menneske ser hvert steg.
Hva som faktisk er nytt
Google skriver at Omni 1.1 nå leser inntil 10 sekunder tidligere kontekst når en scene forlenges. Forrige generasjon så bare på siste sekund. Forlengelse skjer i 10-sekunders steg, opp til 40 sekunder totalt. Hvert kall lager 3 til 10 sekunder ved 24 bilder i sekundet. Første og siste bilde kan låses, slik at kameraet interpoleres mellom to nøkkelrammer. Inntil tre sekunder referansevideo kan brukes for karakter og bevegelse.
Utkast i 360p skal ifølge Google være inntil 60 prosent raskere og koste en tredjedel av standard 720p. Fotnoten er viktig: tallet er systemgjennomstrømming, ikke garantert latenstid på ett kall. 1080p og 4K er oppskalerte utganger, ikke native 4K-generering. Det står i Googles egen dokumentasjon. En RFP som krever «4K-modell» uten å skille generering og oppskalering, kjøper et merke, ikke en kapasitet.
Modellkoden er gemini-omni-1.1-flash. Forhåndsvisningen gemini-omni-flash-preview skal fases ut 30. september 2026. Gemini API-dokumentasjonen lister 1 048 576 tokens kontekst, tekst, bilde og video inn, video ut. Enterprise Agent Platform-dokumentasjonen er trangere: 131 072 inn, 57 920 ut, og merker 1.1 som preview der. Det gapet må innkjøp merke før noen kobler modellen til en intern agent.
Pris, Veo og den dyre modaliteten
Google publiserte en prisoversikt i utviklerbloggen. Effektive satser per generert sekund er 0,03 dollar i 360p, 0,10 dollar i 720p, 0,15 dollar i 1080p og 0,30 dollar i 4K. 720p matcher Veo 3.1 Fast. 4K matcher Veo 3.1 Fast. 360p er den nye kostspaken, ikke et priskutt på ferdige klipp.
API-en fakturerer også i tokens: 1,50 dollar per million inn, 9,00 dollar per million tekst ut, 17,50 dollar per million video ut. Ett sekund 720p telles som 5 792 ut-tokens, altså om lag 0,10 dollar. Ti sekunder 720p koster rundt én dollar før kastede utkast. 40 sekunder er fire kall pluss kontekst. Ingen gratisnivå. Arbeidsflyten Google selger er åpenbar: iterer billig i 360p, skaler opp én godkjent take. Det er riktig for prototyping. Det er også en invitasjon til å brenne budsjett på «én take til» i 4K.
Hva modellkortet advarer om
Modellkortet, sist oppdatert august 2026, dekker både Omni Flash og Omni 1.1 Flash. Kjente begrensninger: full konsistens gjennom redigeringer, kompleks bevegelse, og nøyaktig tekst i bildet. Taleredigering er begrenset; Google sier de holder den tilbake mens de vurderer hvordan den kan slippes trygt. SynthID-vannmerke skal ligge på generert video.
For CISO er det tre konkrete hull. Syntetisk video med tale og merkevare er misbruksmateriell: deepfake, reklame uten samtykke, intern opplæring som ser ekte ut. Provenance hjelper bare hvis mottakeren sjekker; de fleste interne CMS-er sjekker ikke SynthID. Og når Omni ligger i Gemini Enterprise Agent Platform, kan en intern agent forlenge scener uten menneskelig stikkprøve. Da trengs policy på hvem som får kalle gemini-omni-1.1-flash, logging av prompts og referanseklipp, og forbud mot å mate inn persondata og kundevideo uten behandlingsgrunnlag.
Google viser Adobe, Figma, GMI Cloud og Runway som produksjonskunder. Det er et signal om at videogenerering ikke lenger er en labsandkasse. Det er også leverandørkonsentrasjon: samme modell i Googles egne flater og i tredjeparts kreativ verktøykjede.
Hva norske ledere bør gjøre denne uken
Ikke rull dette ut som «AI-video til marked». Sett tre regler først.
Skill utkast og produksjon. 360p i sandbox. 4K bare etter menneskelig godkjenning og merking som AI-generert, i tråd med AI Act artikkel 50. Krev at leverandør og intern plattform logger modell-ID, oppløsning, referanseklipp og om SynthID er verifiserbar ved leveranse. 4K er oppskalering. Ikke kjøp «native 4K» i en kravspesifikasjon. Sett kostnadstak per team. 0,10 dollar per sekund høres billig ut til en styrepresentasjon er 200 klipp à 10 sekunder, pluss kast. Video er den dyre modaliteten.
Og hold tungen rett i munnen på lengde. 40 sekunder er fire genereringer, ikke én sammenhengende take. Konsistens over redigeringer er fortsatt en kjent svakhet i modellkortet. For opplæring, eiendom og produktvideo kan det holde. For merkevarefilm og evidens i en tvist holder det ikke.
Kilder og medier
Primærkilde: Google, «Build with Gemini Omni 1.1 Flash», 27. august 2026: https://blog.google/innovation-and-ai/technology/developers-tools/build-with-gemini-omni-1-1-flash/
Modellkort: Google DeepMind, Gemini Omni Flash (oppdatert 27. august 2026): https://deepmind.google/models/model-cards/gemini-omni-flash/
Gemini API-modellside: https://ai.google.dev/gemini-api/docs/models/gemini-omni-flash
Thumbnail: OpenAI Image 2 / hogby.ai
📬 Likte du denne?
AI-nyheter for ledere. Kuratert av en CIO som bygger det selv. Daglig i innboksen.