Nex-N2.5: Mini og Max åpne – Pro-vektene venter, egne tester
Nex AGI, alliansen rundt Shanghai Innovation Institute, la 8. september ut Nex-N2.5. Tre agentmodeller. Mini på 35 milliarder parametere og Max på 1,6 billioner har Apache 2.0-vekter på Hugging Face. Pro på 397 milliarder kjøres som gratis API på OpenRouter. Vektene der er merket «coming soon».
Det er en familie for lange agentløp med datamaskin og nettleser, ikke et nytt ChatGPT. Labens egne tall legger Max inntil Claude Opus 5 på AutomationBench. På SWE-Bench Pro ligger Max 13 poeng bak. For CIO er skillet poenget: åpne vekter på Mini og Max, API-avhengighet på Pro, og tester kjørt i labens eget seletøy.
Hva som faktisk er ute
Mini er MoE bygd på Qwen3.5-35B-A3B-Base. 35 milliarder parametere, tre milliarder aktive. Tekst og bilde inn, tekst ut. 16 safetensors-filer, opprettet 8. september. 262 144 tokens kontekst i OpenRouter. Labens anbefalte kjøring: to H100.
Pro er MoE bygd på Qwen3.5-397B-A17B. 397 milliarder, 17 milliarder aktive. Samme multimodalitet. Anbefalt: åtte H100. Hosted som nex-agi/nex-n2.5-pro:free fra 8. september 17:54 UTC. Kortet på Hugging Face sier vektene kommer. Ikke last ned det som ikke ligger der.
Max er MoE bygd på DeepSeek-V4-Pro-Base. 1,6 billioner parametere, 49 milliarder aktive. Bare tekst. 644 safetensors-shards. Anbefalt: to noder, 16 H200, tensorparallell 16, 262 144 tokens. Det er et cluster-vedtak, ikke en laptop-modell.
Lisens på Mini og Max: Apache 2.0. Ingen gating på de to vektrepoene. Mini hadde 2 444 nedlastinger og 637 likes da vi sjekket 10. september. Max: 398 nedlastinger. NexCUA, seletøyet for datamaskinbruk, er varslet åpen senere. Ikke i dag.
Tallene Nex AGI selv oppgir
Alle agent- og kodescore under er labens målinger, delvis i NexAU og NexCUA. Der offentlige ledertavler finnes, viser de til dem. Resten er egne kjøringer. Temperatur 0,7. Bruk dem som leverandørclaim, ikke som innkjøps-SLA.
Terminal-Bench 2.1: Mini 73,4, Pro 82,7, Max 86,1. Claude Opus 5: 89,1. GPT-5.6 Sol: 88,8.
SWE-Bench Pro: Mini 43,8, Pro 61,2, Max 65,7. Opus 5: 79,2. Der taper de tydelig på programvarearbeid.
DeepSWE v1.1: Max 65,6 mot Opus 73,7 og Sol 72,7.
AutomationBench v1.0.6, offentlig versjon: Max 50,2, Opus 5 50,3. Uavgjort på labens bane, ikke en seier. Job Bench: Max 53,6 mot Opus 65,7. GDPval-AA v2: Max 1713 mot Opus 1831.
OSWorld-2: Pro 56,4 mot Qwen3.8-Max 46,7 og Opus 5 68,3. BrowseComp: Max 92,6, foran Opus 90,8, med sammendragskomprimering når konteksten passerer 60 prosent. OSWorld-G: Pro 87,4, foran Opus 76,8 i labens GUI-kjøring.
WebTest er oracle-modus: sjekkliste gitt, bare feildeteksjon. Ikke full agent. OSWorld, WebTest og WebArena er kjørt i NexCUA med klikkkoordinater normalisert til 0–1000. Coding er kjørt i NexAU. Det er ikke Artificial Analysis, og det er ikke Arena.
Hva det koster å eie versus å låne
OpenRouter tar 0 dollar for Mini og Pro i øyeblikket. Gratis lag er ikke produksjon. Ingen SLA, ingen databehandleravtale du kan vise styret, og kvoter kan forsvinne over natten.
Selvhost: Mini på to H100 er innenfor et GPU-cluster mange nordiske team allerede har. Pro på åtte H100 er et prosjekt, og vektene er ikke ute. Max på 16 H200 er et budsjettvedtak. NexRT, labens egen motor for Pro, er bygd for én forespørsel av gangen på åtte H100 eller H200, med SGLang på prefill.
Tenkemodus: none, medium (standard) eller high. Verktøykall via qwen3_coder-parser. Max bruker deepseek-r1-reasoning-parser. Det er Qwen- og DeepSeek-arv, ikke en ny stabel du eier alene.
Hva ledelsen bør gjøre
Computer use er sikkerhetssaken. Mini og Pro er trent til å styre skjerm, nettleser, Blender og CAD, og å rette seg etter det de ser. En agent med visuell tilbakemelding er et nytt angrepsflate: injeksjon i UI, datauttrekk via skjerm, og uautorisert handling i vanlige apper. Kjør dem i isolert VM, med logging av hvert GUI-steg, ikke på en bærbar med postkasse og bank.
Leverandørrisiko: Nex AGI er en kinesisk allianse. Apache 2.0 på vektene gir deg rett til å kjøre Mini og Max selv. Det gir deg ikke en vestlig databehandler. API-et på OpenRouter er et annet spor enn vektene. Bland dem ikke i risikoregisteret.
Ikke bytt ut Opus, Astra eller Fable 5.1 på koding. SWE-Bench Pro og DeepSWE viser avstand. Bruk Mini der du vil ha lokal, billig computer-use-agent med åpne vekter. Vent med Pro til vektene faktisk ligger der. Max er et forskningscluster, ikke en SaaS-erstatning.
Kilder og medier
Primærkilde: Nex AGI, https://nex-agi.com/ GitHub-kunngjøring: https://github.com/nex-agi/Nex-N2.5 Hugging Face: Mini og Max med safetensors, Pro merket coming soon. Thumbnail: OpenAI Image 2 / hogby.ai
📬 Likte du denne?
AI-nyheter for ledere. Kuratert av en CIO som bygger det selv. Daglig i innboksen.