Hopp til hovedinnhold
 AI-nyheter, ferdig filtrert for ledere
SISTE:

Dommer river Pentagons Anthropic-svartelisting – kaller den grunnløs • Alabama stevner OpenAI etter agentinnbruddet i Hugging Face • Bloomberg: NVIDIA-kunder varsles om over 15 prosent prishopp på AI-servere • OpenAI kutter GPT-5.6 Sol mer enn 20 prosent – i tre måneder

Grok 4.6 i Google Cloud: Preview, global og 13 kall i minuttet
AI-modellerxAIGoogle CloudEnterpriseCIO

Grok 4.6 i Google Cloud: Preview, global og 13 kall i minuttet

JH
Joachim Høgby
21. august 202621. august 20265 min lesingKilde: xAI

xAI har ikke sluppet en ny Grok. De har flyttet flaggskipet inn i Google Cloud. 21. august skrev xAI at Grok 4.6 er tilgjengelig på Google Enterprise Agent Platform, via Model Garden. Google Clouds eget modellkort har samme dato og merker utgivelsen Preview. Det er poenget for en leder: dere kan nå kjøpe Grok under eksisterende Google-kontrakt, men dere kjøper ikke GA, og dere kjøper ikke kapasitet i det tempoet agentflåter vanligvis krever.

Modellen er den samme som xAI lanserte 12. august. xAI beskriver den som bygd for lange agentløp og interaktivt, visuelt arbeid. Kontekstvinduet er 500 000 token, hos Google oppgitt som 524 288. Resonnering kan settes til low, medium, high eller xhigh. Prisen xAI oppgir på Google-flaten er 2 dollar per million input-token, 0,50 dollar for cache-treff og 6 dollar per million output-token. Det er ikke et priskutt. Det er en ny fakturakanal.

Google er tydeligere enn pressemeldingen. Modell-ID er grok-4.6. Inn er tekst og bilde. Ut er tekst. Function calling, strukturert output og reasoning er merket Preview. Batch er ikke støttet. Standard pay-as-you-go er ikke støttet. Provisioned Throughput er ikke støttet. Det som er støttet, er fast kvote på et globalt endepunkt. Kvotene Google oppgir nå er 13 kall i minuttet, 188 000 input-token i minuttet og 16 000 output-token i minuttet. Tretten kall er en pilot, ikke en produksjonssløyfe. 16 000 output-token i minuttet er enda strammere når flere agenter resonnerer samtidig. xHigh-modus spiser den kvoten fort.

Google hadde allerede andre Grok-varianter i Model Garden: 4.3, 4.20 med og uten resonnering, og 4.1 Fast. 4.6 er altså ikke første xAI-modell bak Google-IAM. Det er flaggskipet som lander som Preview-SKU. For innkjøp betyr det at kanalen finnes, mens produksjonsgarantien for nettopp denne versjonen ikke gjør det.

Tilgjengeligheten er global, ikke regional. xAI-dokumentasjonen for Vertex AI og Gemini Enterprise Agent Platform peker på at regionale endepunkter finnes for strengere residenskrav, men Grok 4.6-kortet lister bare global. For en nordisk virksomhet med krav til EU-region er det en stans, ikke en fotnote. Databehandling og retensjon følger Googles Vertex-regelverk, ikke xAIs egen API-kontrakt. xAI skriver at mange Google-deployments støtter Zero Data Retention, og at request-response-logging kan slås på for revisjon. Det må sjekkes per prosjekt, ikke antas fra modellnavnet.

Teknisk er det en partnermodell bak OpenAI-kompatibelt grensesnitt. xAI viser både Responses API og Chat Completions, med modellprefiks xai/grok-4.6 i egne eksempler. Autentisering skal gå via Application Default Credentials og IAM, ikke langlivede nøkler. Det er den reelle gevinsten for CISO: Grok kan ligge i samme nøkkelrotasjon, revisjonslogg og faktura som resten av Google Cloud. Det er også den reelle bindingen. Når agentene først er sydd mot Model Garden, kvoter og logging, er utgangen tilbake til xAI-API en ny risikovurdering, ikke en config-linje.

For innkjøp er rekkefølgen derfor omvendt av det leverandørene vil at dere skal lese. Først: er Preview akseptabelt for den arbeidsflyten? Deretter: tåler dere global ruting? Så: holder 13 QPM og 16 000 output-TPM hvis tre team tester samtidig? Først da kommer evnen. Grok 4.6 kan være riktig modell for kode, verktøykall og lange oppgaver. Den er allerede i Copilot og hos xAI direkte. Google-flaten er et kontrollspørsmål, ikke et evnespørsmål.

Det som ikke følger med 21. august, er like viktig. Ingen ny systemkort. Ingen nye åpne vekter. Ingen lovnad om GA-dato, regional residens eller Provisioned Throughput. Forbrukerchat og apper er fortsatt i trinnvis utrulling. Hvis noen i ledergruppen hører «Grok er i Google Cloud» og hører produksjon, har de hørt feil. De har hørt at innkjøpskanalen er åpen, og at kapasiteten er skrudd igjen.

Sett det i policy før noen slår på Model Garden. Hvem får Enable. Hvilket prosjekt. Om logging skal stå på. Om ZDR er avtalt. Hva som skjer når 13 QPM blir 429. Og hvem som eier beslutningen om å bli værende i Google-kanalen når kvotene løsner.

Kilder og medier

Primærkilde: xAI, «Grok 4.6 on Google Enterprise Agent Platform», 21. august 2026. https://x.ai/news/grok-4-6-vertex-ai

Google Cloud, modellkort for Grok 4.6 i Gemini Enterprise Agent Platform, sist oppdatert 21. august 2026. https://docs.cloud.google.com/gemini-enterprise-agent-platform/models/partner-models/grok/grok-4-6

Google Cloud, oversikt over xAI Grok som partnermodeller. https://docs.cloud.google.com/gemini-enterprise-agent-platform/models/partner-models/grok

xAI Docs, «Google Cloud Vertex AI». https://docs.x.ai/developers/community/google-cloud-vertex-ai

Thumbnail: OpenAI Image 2 / hogby.ai

📬 Likte du denne?

AI-nyheter for ledere. Kuratert av en CIO som bygger det selv. Daglig i innboksen.