Google gjør Gemini til hjerne for humanoide roboter
Google DeepMind har lansert Gemini Robotics 2, en ny familie modeller for fysisk AI. Dette er ikke enda en chatbot med bedre svar. Det er Googles forsøk på å gjøre Gemini til et operativt intelligenslag for roboter som må se, planlegge, bevege seg og samhandle med mennesker i den fysiske verden.
Lanseringen består av tre deler. Gemini Robotics 2 er en vision-language-action-modell som oversetter syn og språk til motorisk kontroll. Den skal kunne styre humanoider fra føtter til fingertupper, ikke bare en robotarm på et bord. Gemini Robotics ER 2 er den agentiske resonneringsmodellen som fungerer som høynivå-hjernen: den forstår video, kommuniserer med mennesker, planlegger oppgaver over flere minutter og koordinerer hvilke lavnivåmodeller eller robot-API-er som skal gjøre jobben. Gemini Robotics On-Device 2 er den lokale VLA-modellen som skal kjøre på roboten og tilpasse seg nye robotkropper med få timer data.
Det gjør saken viktigere enn en vanlig demo-video. I programvareverdenen har AI-agenter allerede begynt å flytte seg fra svar til handling. Robotics 2 viser den samme bevegelsen i fysisk infrastruktur. Modellen skal kunne bryte en oppgave ned i trinn, følge med på fremdrift i video, korrigere når noe feiler og overlevere mellom ulike roboter. Google viser blant annet Apptroniks Apollo 2 humanoid som går, bøyer seg og plukker opp objekter etter naturlig språk, samt samarbeid mellom Apollo og en annen robotplattform i et garasje-scenario.
For ledelsen er det mest interessante skillet mellom show og system. En robot som kan plukke opp en vannkanne på video er morsom. En modellarkitektur der resonnering, planlegging, sikkerhetsvurdering, lokal kontroll og hardware-tilpasning deles i lag er mer relevant. Det er slik fysisk AI kan bli kjøpbart, styrbart og integrerbart i industri, logistikk, byggdrift, helse, renhold og beredskap over tid. Ikke i morgen morgen, men raskere enn tradisjonell robotautomatisering pleier å bevege seg.
Google legger også inn et tydelig utviklerspor. Gemini Robotics ER 2 er tilgjengelig via Gemini API og Google AI Studio, og i privat preview på Gemini Enterprise Agent Platform. VLA-modellene og On-Device 2 går først til early-access-partnere. Det betyr at virksomheter neppe kjøper en komplett generell robot på fredag, men at økosystemet rundt fysisk agentutvikling nå får en modell som kan testes i verktøykjeder, simulering, kontrollerte piloter og partnerhardware.
Det strategiske spørsmålet for CIO er derfor ikke "skal vi kjøpe humanoider?". Det riktige spørsmålet er hvilke operasjonelle prosesser som kan bli påvirket når AI-modeller får et fysisk handlingsrom. Lager, inspeksjon, vareflyt, kantproduksjon og teknisk service er mer nærliggende enn kontorroboten som henter kaffe. Særlig interessant er kombinasjonen av agentisk planlegging og lokale modeller. Hvis en robot må vente på skyen for hvert steg, blir sikkerhet, latency og robusthet fort et problem. On-Device 2 peker mot mer driftssikre løsninger der skyen trener og orkestrerer, mens kritiske bevegelser kan skje nær maskinen.
For CISO og risikoeier er det samtidig en annen liga enn digitale agenter. Når en modell tar feil i et regneark, får du rot. Når den tar feil med en robotarm, kan du få personskade, produksjonsstans eller ødelagt utstyr. Google omtaler derfor sikkerhet som en sentral del av lanseringen, inkludert ASIMOV-Agentic, et nytt benchmark for agentisk sikkerhetsorkestrering og usikkerhetshåndtering. Robotics ER 2 skal også gjøre det bedre på menneskenærhet og sikkerhetsinstruksjoner, inkludert å stoppe når mennesker kommer for nær. Det er riktig retning, men også en påminnelse: fysiske agenter må styres med annen governance enn rene kontorassistenter.
Det kommersielle signalet er bredere. Google forsøker å eie et nytt lag i robotstacken: ikke selve roboten, men modellen som gjør mange robotkropper mer fleksible. Hvis dette lykkes, kan robotics-markedet begynne å ligne mer på sky- og AI-plattformmarkedet: hardwarepartnere, modellkort, API-er, sikkerhetsrapporter, trusted tester-programmer og enterprise-kontroller. Da blir leverandørvalg, dataflyt, ansvarsdeling og sertifisering like viktig som mekanikken i roboten.
Det finnes fortsatt store forbehold. Google skriver selv at hastighet og presisjon må videreutvikles, og at flerfinger-manipulasjon fortsatt er krevende. Mange demoer skjer i kontrollerte miljøer, og ingen virksomhet bør tolke dette som produksjonsklar autonomi i åpne rom. Likevel er nivåhevingen tydelig: Robotics 2 handler ikke bare om å gjenkjenne objekter, men om langvarig oppgaveforståelse, fremdriftssporing, multi-robot-koordinering og sikker orkestrering.
For norske ledere er konklusjonen enkel: følg dette som infrastruktur, ikke futurisme. Gemini Robotics 2 er et tegn på at modellkappløpet beveger seg ut av nettleseren og inn i fysisk drift. Den praktiske effekten kommer først via smale piloter og partnere, men beslutningene som avgjør hvem som får verdi av dette tas tidligere: prosesskartlegging, datatilgang, sikkerhetsrammer, hardwarestrategi og klare krav til ansvarlig autonomi.
Kilder og medier
Primærkilde: Google DeepMind, "Gemini Robotics 2 brings whole body intelligence to robots": https://deepmind.google/blog/gemini-robotics-2-brings-whole-body-intelligence-to-robots
Støttende materiale omtalt i primærkilden: Google Developer Blog om Gemini Robotics ER 2, modellkort for ER 2 og On-Device 2, samt Gemini Robotics 2 Safety Technical Report.
Thumbnail: OpenAI Image 2 / hogby.ai
📬 Likte du denne?
AI-nyheter for ledere. Kuratert av en CIO som bygger det selv. Daglig i innboksen.