Qwen 3.8-Max-0902: kode-løft i API – vektene er de gamle
Alibaba har sluppet Qwen3.8-Max-0902. Det er et snapshot av 3.8-Max, ikke en ny modellfamilie. Samme pris. Samme 1 million tokens. Samme 2,4 billioner parametre. Det som er nytt, er post-trening på koding og cowork, og at snapshotet er live i QwenCloud og Alibaba Cloud Model Studio.
For CIO og CISO er det tre beslutninger: om modell-ID-en qwen3.8-max-0902 skal byttes inn som default i kodeagenter, om dere tåler at de åpne vektene fortsatt er august-sjekkpunktet, og om kinesisk sky og datalokasjon er akseptabelt for den trafikken.
Hva som faktisk er lansert
Modell-ID er qwen3.8-max-0902, alias qwen3.8-max-2026-09-02. QwenCloud beskriver den som et oppgradert snapshot av qwen3.8-max. Alibaba Cloud Model Studio oppdaterte dokumentasjonen 2. september.
Arkitekturen er uendret: 2,4 billioner parametre totalt, 95 milliarder aktive per token, 1 million tokens kontekst. Inn: tekst, bilde og video. Ut: tekst. Tenkemodus, funksjonskall, strukturert utdata og kontekstcache er støttet. Fine-tuning er ikke støttet. Batch-inferens er ikke støttet på 0902-snapshotet, selv om stammodellen har batch i Beijing.
Prisen er den samme som 3.8-Max. På internasjonal QwenCloud: 2 dollar per million input, 6 dollar per million output. Implisitt cache 0,25 dollar. Eksplisitt cache-les 0,17 dollar. I Kina, Frankfurt, Virginia, Tokyo og Hongkong ligger stamkortet lavere, rundt 1,65/4,95 dollar. Det er ingen langt-prompt-tillegg over 1M-vinduet.
Verktøystakken på Responses API er den samme: code_interpreter, web_search, web_extractor, t2i_search og i2i_search.
Qwen sier kodingen «breaks new ground» på ingeniørskala og langhorisont autonom utvikling, at samarbeidende agenter er mer rolige i fler-verktøy-orkestrering, og at visjonen er skarpere på diagrammer, dokumenter og multimodal persepsjon. Det er leverandørens formulering.
Tallene som faktisk er nye
Den eneste uavhengige plasseringen som fulgte med 0902, er Code Arena WebDev. Alibaba oppgir at snapshotet debuterte på topp med 1 691 poeng, 22 over forrige 3.8-Max, tre over Claude Opus 5 Max og 17 over Kimi K3 Max. Arenaen er tredjepart og blind avstemning. Poengene flytter seg. «Debutert som nummer én» er Alibabas øyeblikksbilde, ikke en låst rangering.
Alibabas eget sammenligningsark, gjengitt av DataCamp, viser løft på alle åtte kode-benchmarks mot 3.8-Max. De største hoppene er interne: TerminalBench 3.0 fra 11,3 til 29,0, ProgramBench Almost Solved fra 10,5 til 28,0. Begge mer enn dobles. Begge ligger fortsatt bak Claude Opus 5 (42,7 og 41,5).
0902 leder Opus 5 på tre kode-evaler i samme tabell: MLS-Bench-Lite 50,1 mot 49,8, SWE-Atlas QnA 66,3 mot 63,2, og QwenSWEBench V2 70,0 mot 68,0. På DeepSWE 1.1 er det 69,3 mot Opus 73,6. På JobBench 64,0 mot 67,8. WorkArena Elo 1 468 mot Opus 1 437. CoWorkBench 76,1 mot 79,6.
Dette er Alibabas tabell. Artificial Analysis Intelligence Index på 56 gjaldt 3.8-Max, ikke 0902. Dere har ikke et uavhengig totalindeks-tall for snapshotet ennå.
Hva som ikke er lansert
De åpne vektene er ikke 0902. Qwen3.8-2.4T-A95B og FP8-varianten kom 12. august under en egen Qwen3.8-Max-lisens, ikke Apache 2.0. Qwen3.8-27B kom 14. august under Apache 2.0. Snapshotet i skyen er videre post-trent. Self-hosting av 0902 er ikke tilbudt.
Fine-tuning av 0902 er av. Batch er av. Computer-use som eget produkt er ikke det som er sluppet her. Dette er et API-snapshot.
Hva dette betyr for ledergruppen
Hvis dere allerede kjører 3.8-Max i kodeagenter mot QwenCloud eller DashScope, er byttet en modell-ID og en regresjonstest. Prisen rører dere ikke. Cache-økonomien er den samme. Det er det billigste argumentet for å teste.
Hvis dere velger kinesisk flaggskip som workhorse, er datalokasjon og leverandørstyring saken, ikke poengene. Singapore er internasjonalt endepunkt. Beijing er Kina. Frankfurt, Virginia, Tokyo og Hongkong ligger i Alibabas globale rute. Web search er av i flere globale regioner på stammodellen, men dokumentasjonen lister den som støttet på 0902. Verifiser per region før dere lover søk i produksjon.
CISO bør behandle 0902 som stengt sky, ikke som åpen vekt. Prompt, repo og logger går til Alibaba. Eksportkontroll, kundeklausuler og «ingen Kina-behandling»-krav i kontrakter er harde stopp, uansett Code Arena.
FinOps: 2/6 dollar er langt under Opus 5. Arena-paretoen Alibaba peker på, er rundt 5 dollar blended per million tokens. Det er relevant for volume-koding. Det er irrelevant hvis dere ikke kan sende koden dit.
Test på egne pipelines. TerminalBench 3.0 på 29 mot Opus 42,7 er et varsel om at leverandørens «breaks new ground» ikke er SOTA på agentisk terminalarbeid. WebDev-arena er noe annet enn å patche et internt monorepo.
Kilder og medier
Primærkilde: Qwen, QwenCloud-modellside for Qwen3.8-Max-0902: https://www.qwencloud.com/models/qwen3.8-max-0902
Alibaba Cloud Model Studio, qwen3.8-max (oppdatert 2. september 2026): https://www.alibabacloud.com/help/en/model-studio/qwen3-8-max
TechNode: Alibaba upgrades Qwen3.8-Max with a new 0902 snapshot.
Thumbnail: OpenAI Image 2 / hogby.ai
📬 Likte du denne?
AI-nyheter for ledere. Kuratert av en CIO som bygger det selv. Daglig i innboksen.