Hopp til hovedinnhold
 AI-nyheter, ferdig filtrert for ledere
SISTE:

Dommer river Pentagons Anthropic-svartelisting – kaller den grunnløs • Alabama stevner OpenAI etter agentinnbruddet i Hugging Face • Bloomberg: NVIDIA-kunder varsles om over 15 prosent prishopp på AI-servere • OpenAI kutter GPT-5.6 Sol mer enn 20 prosent – i tre måneder

Qwen åpner Max-skalaen: 2,4T-parametermodell for agentarbeid
AI-modellerOpen weightsAgent-AICIOCISO

Qwen åpner Max-skalaen: 2,4T-parametermodell for agentarbeid

JH
Joachim Høgby
17. august 202617. august 20265 min lesingKilde: Qwen / Alibaba

Alibaba/Qwen har gjort noe som betyr mer enn enda en modellpost i feeden: selskapet har sluppet åpne vekter for Qwen3.8-2.4T-A95B, Max-nivået i Qwen3.8-familien. Den offisielle X-meldingen sier at Qwen3.8-27B og Max-varianten nå er tilgjengelige for nedlasting, deploy og bygging. Samme dag meldte Qwen at Qwen3.8-Max også var live hos Together AI med 2,4 billioner parametere, 95 milliarder aktive parametere og 1M kontekstvindu.

Dette er ikke en liten lokalmodell for hobbybruk. Det er en MoE-modell i Max-klassen, pakket for kode, arbeidsflyter, research og lange agentoppgaver. Qwen skriver på Hugging Face at dette er første gang en Qwen-Max-klassemodell tas til åpen utgivelse, og at modellen er bygget for å fullføre komplekse flertrinnsoppgaver med høyere pålitelighet. Det er akkurat der lederrisikoen ligger: jo bedre slike modeller blir til å drive arbeidsflyter selv, desto viktigere blir det å skille modellkapabilitet fra virksomhetsstyring.

Hva som faktisk er nytt

Den offentlige modellen på Hugging Face heter Qwen3.8-2.4T-A95B. Den er en åpen vektslipp av Max-nivået, kompatibel med kjente serveringsmiljøer som vLLM og SGLang. Modellen har 2,4T totale parametere og 95B aktive parametere per token. Qwen posisjonerer den mot agentisk koding, profesjonelt arbeid, research og lange horisonter, ikke bare chat.

Det viktige for CIO og CISO er nyansen mellom Qwen3.8-Max som hostet tjeneste og Qwen3.8-2.4T-A95B som åpen modellfil. Hugging Face-kortet sier at den hostede Qwen3.8-Max-versjonen har ekstra produktfunksjoner som bildeinput, ikke-tenkemodus, 1M kontekst som standard og innebygde verktøy. Den åpne checkpointen beskrives derimot som tekst-only, med thinking-modus påkrevd. Det betyr at anskaffelse, testing og risiko ikke kan behandles som én og samme ting bare fordi modellnavnet er likt.

Qwen oppgir sterke tall på egne og offentlige evals: blant annet Terminal Bench 2.1, SWE-bench Pro, PaperBench, AndroidBench, Toolathlon Verified, WideSearch, GPQA Diamond og juridiske/finansielle oppgaver. Som alltid må egenrapporterte benchmarktabeller tas med salt, spesielt når harness, timeout, tokenbudsjett og agentverktøy varierer. Men retningen er tydelig: åpne modeller konkurrerer ikke lenger bare på svar i en chatboks. De konkurrerer på arbeid utført gjennom verktøy, repoer, filer, tester og lange prosesser.

Lederpoenget: åpen vekt er ikke automatisk lav risiko

For norske virksomheter er dette en dobbel beskjed. Den gode nyheten er at en Max-klassemodell med åpne vekter gir mer forhandlingsmakt, mer lokal kontroll og flere muligheter for private agentløp. Team som ikke vil sende hele kodebaser, kontrakter eller interne prosessdata til en lukket API, får et mer reelt alternativ. Det kan redusere leverandørlåsing og gi bedre kontroll med logging, dataflyt og tilgangsstyring.

Den dårlige nyheten er at åpen vekt ikke betyr ferdig styrt. En modell som er optimalisert for lange agentløp kan gjøre mye skade hvis den kobles til feil verktøy med for brede rettigheter. Risikoen flytter seg fra “hva svarer modellen?” til “hva kan agenten faktisk gjøre?”. Det gjelder kodeendringer, shell-kommandoer, nettleserhandlinger, datatilgang, dokumentgenerering og interne beslutningsflyter.

Særlig bør sikkerhetsmiljøer merke seg tre ting. Først: 1M-kontekst og lange arbeidsløp gjør prompt injection og kontekstforgiftning mer alvorlig. Forurensede filer, issues, nettsider eller dokumenter kan leve lenge i en agentøkt. For det andre: egenhosting gjør drift, patching, observability og tilgangskontroll til eget ansvar. Det holder ikke å få modellen til å svare pent i en demo. For det tredje: lisens og bruksbegrensninger må leses før modellen legges inn i kommersielle arbeidsassistenter, spesielt fordi Max-slippet bruker egen Qwen3.8-Max-lisens.

Hva virksomheter bør gjøre nå

Ikke kast modellen rett inn i produksjon. Test den som en agentkomponent med samme alvor som en ny identitetsplattform. Start med isolerte sandkasser, read-only repoer og eksplisitte verktøygrenser. Mål ikke bare benchmarkscore, men feilmodus: hvor ofte forsøker modellen å omgå policy, overbruke tokens, misforstå repo-kontekst, skape uønskede filer, gjøre irreversible valg eller late som en verifisering er gjort.

For teknologiledere er en fornuftig testpakke enkel: én kodebase, én dokumentflyt, én researchflyt og én sikkerhetskritisk negativtest. Kjør Qwen3.8-2.4T-A95B mot dagens lukkede leverandørmodell, men med identiske verktøy, tidsgrenser og logging. Hvis modellen vinner på kost eller datakontroll, men taper på styrbarhet, er den ikke produksjonsklar. Hvis den leverer stabilt i sandkassen, kan den bli en kraftig kandidat for lokale agentarbeidsflater.

Den strategiske betydningen er likevel klar. Alibaba/Qwen skyver åpen-modellmarkedet oppover fra “god nok lokal chat” til “åpne agentmodeller for reelt arbeid”. Det presser OpenAI, Anthropic, Google og xAI på en annen måte enn små modeller gjør. Kundene får flere valg. Men ansvaret for governance flytter samtidig nærmere kunden. Åpen Max-skala er ikke en gratis gevinst. Det er en kraftig motor. Den trenger bur, bremser og dashbord før den får nøkler til virksomheten.

Kilder og medier

Primærkilde: Qwen / Alibaba, https://x.com/Alibaba_Qwen/status/2088280182356611304 Supplerende kilder: Qwen3.8-Max-blogg, https://qwen.ai/blog?id=qwen3.8; Qwen3.8-2.4T-A95B på Hugging Face, https://huggingface.co/Qwen/Qwen3.8-2.4T-A95B; Together AI-tilgjengelighet via Qwen, https://x.com/Alibaba_Qwen/status/2088285662223138851 Thumbnail: OpenAI Image 2 / hogby.ai

📬 Likte du denne?

AI-nyheter for ledere. Kuratert av en CIO som bygger det selv. Daglig i innboksen.