Hopp til hovedinnhold
 AI-nyheter, ferdig filtrert for ledere
SISTE:

OpenAI dots: Astra 24/7 – Pro stengt i EØS, 4000 apper • AISI: Astra 29 prosent – falsk identitet, payload utenfor scope • OpenAI-agenter: 16 500 UNCTAD-skann – XSS-spill, 82 rate-limits • OpenAI: DNS-hull – pause i trening av de mest kapable • OpenAI-agenter la ut 53 brukerbilder – kan ikke varsle ofrene

Gemini 3.8 Live Avatar: GA i Enterprise – EU-ende, 0,39 dollar/min
GoogleGeminiCIOCISOAI-modellerEnterprise

Gemini 3.8 Live Avatar: GA i Enterprise – EU-ende, 0,39 dollar/min

JH
Joachim Høgby
24. september 202624. september 20265 min lesingKilde: Google Cloud

Google gjør Gemini 3.8 Live med Live Avatar allment tilgjengelig i Gemini Enterprise 24. september. Det er tale-til-tale med synkronisert ansikt, ikke en ny frontier-tekstmodell. US- og EU-endepunkt er på plass. Egendefinerte ansikter er allowlist. Video koster 6192 tokens per sekund når avataren snakker.

Hva er nytt

Google Cloud kaller funksjonen generally available i Gemini Enterprise. Den ble vist på Google Cloud Next 2026 og kommer én uke etter at Gemini 3.8 Live og Gemini 3.8 Live Extended Thinking ble lansert. Extended Thinking ligger fortsatt i privat forhåndsvisning.

Modell-ID i Agent Platform er gemini-3.8-live. Live og Live Extended Thinking tar lyd, bilde, video og tekst med inntil 128 000 tokens kontekst. Uten avatar er utdata lyd og tekst med 64 000 tokens. Med Live Avatar synker utdatabudsjettet til 24 000 tokens, ifølge Google DeepMinds modellkort for Gemini 3.8 Audio.

Funksjonene Google lover i produksjon:

Videoavatarer med leppe-synk. Ferdige avatarer er åpne for Gemini Enterprise. Avatar fra eget referansebilde krever allowlist og verifisering.

Native tale-til-tale, med avbrudd uten å miste samtalekontekst eller bakgrunnstransaksjoner.

Asynkrone verktøykall mens samtalen fortsetter, slik at API-, CRM- og ERP-kall kan kjøre i bakgrunnen.

97 språk med automatisk språkbytte. Google sier leppe-synk og mimikk skal følge med uten visuell drift.

Live visuell forståelse av kamera og skjermdeling samtidig med lyd.

Google oppgir provisioned throughput, virksomhetscompliance og «strict data governance». Det er leverandørens formulering, ikke en uavhengig attest.

Pris

Gemini 3.8 Live API, non-global, per million tokens ifølge Google Clouds prisliste:

Tekst inn 0,75 dollar. Bilde og video inn 1,00. Lyd inn 3,00. Tekst ut 4,50. Lyd ut 12,00. Video ut for avatar 1,00.

Google oppgir 25 lydtokens per sekund og 6192 videotokens per sekund når avataren snakker. Idle lytting faktureres ikke for video. Ett minutt tale blir da om lag 0,37 dollar for video og 0,018 dollar for lyd, totalt rundt 0,39 dollar. Uten avatar er samme minutt om lag 0,02 dollar.

Live-fakturering er per tur. Hele sesjonsvinduet, inkludert tidligere turer, telles på nytt hver tur opp til konfigurert kontekstgrense. For en kundesamtale som varer, vokser kostnaden raskere enn minuttraten alene viser.

Begrensninger Google selv skriver

Modellkortet sier at Live Avatar tåler noen minutter sammenhengende interaksjon, ikke timer. Kunnskapsgrensen er januar 2025. Arkitekturen er basert på Gemini 3 Pro.

I Frontier Safety Framework viser Google til Gemini 3.7 Flash og skriver at 3.8 Live ikke har meningsfulle nye kapabiliteter eller materiell ytelsesøkning mot den. De konkluderer at 3.8 Live sannsynligvis ikke når Tracked eller Critical Capability Levels. Det er Googles egen vurdering, knyttet til en eldre Flash-modell, ikke en ny uavhengig grensevurdering av videoagenten.

Hva det betyr

For CIO er dette en produksjonskanal for stemme- og videoagenter i Gemini Enterprise, med EU-ende. Det treffer kundeservice, kiosk og salg mer enn kodeagenter. Cox Automotive, Equal AI, Salesforce Agentforce og Specs er sitert av Google. Det er kundecitater i et lanseringsnotat.

For CISO er ansiktet poenget. En videoagent som ligner en ansatt, er identitets- og deepfake-risiko. Google stenger egendefinerte ansikter bak allowlist og merker lyd og video med usynlig SynthID. Vannmerket hjelper den som kan detektere det. Det erstatter ikke policy for hvem som får lov til å klone et ansikt, og det sier ingenting om hva mottakeren ser.

Kostnaden er den andre fellen. 0,39 dollar per minutt i tale er synlig. Re-fakturering av hele sesjonen er den som treffer FinOps når agenten holder kontekst.

Dette erstatter ikke GPT-6 Astra eller Claude Opus 5.5 som arbeidsmodell. Det er en multimodal live-flate oppå Gemini 3.8, i Googles enterprise-stack, med ansikt på.

Kilder og medier

Primærkilde: Google Cloud, https://cloud.google.com/blog/products/ai-machine-learning/gemini-3-8-live-with-live-avatar-is-now-generally-available

Google Keyword: https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-8-live-with-live-avatar/

Modellkort: https://deepmind.google/models/model-cards/gemini-3-8-audio/

Pris: https://cloud.google.com/gemini-enterprise-agent-platform/generative-ai/pricing

Thumbnail: OpenAI Image 2 / hogby.ai

📬 Likte du denne?

AI-nyheter for ledere. Kuratert av en CIO som bygger det selv. Daglig i innboksen.