AA: Sonnet 5.5 på 56 – 193k tokens, 50 prosent dyrere
Artificial Analysis setter Claude Sonnet 5.5 på 56 i Intelligence Index ved max effort. Det er 18 poeng over Sonnet 5 og to bak Opus 5.5. Listen er uendret: 2 dollar per million input-tokens, 10 dollar per million output. Regningen er ikke det. Ved max koster Sonnet 5.5 7,60 dollar per oppgave, om lag 50 prosent mer enn Sonnet 5, fordi den spytter ut flest output-tokens AA har målt.
Anthropic solgte lanseringen 28. september som over 30 prosent raskere og inntil 30 prosent billigere per oppgave. AA-målingen ved max er den motsatte historien. For CIO er effort-spaken innkjøpsbeslutningen, ikke listen.
56, og hva det koster
Ved max ligger Sonnet 5.5 på andreplass. AA-Briefcase 1811 Elo mot Opus 5.5s 1822. GDPval-AA 1844 mot 1846. AutomationBench-AA 71 prosent mot 70. Terminal-Bench 4.0 64 prosent mot 60 for både Opus 5.5 og GPT-6 Astra. Det er AA-harness. Anthropic oppgir 70,6 prosent på samme test. Ikke bland tallene.
Prisen for nær-Opus er tokenvolum. Om lag 193 000 output-tokens per Intelligence Index-oppgave ved max. Høyest AA har målt. Rundt 60 prosent mer enn Opus 5.5 max og Sonnet 5 max. Rundt sju ganger GPT-6 Astra max.
Listen matcher GPT-6 Sol. På intelligence mot kostnad per oppgave sitter Sonnet 5.5 likevel utenfor Pareto-fronten. Ved high effort er den mest konkurransedyktig, rett bak Sol på intelligence til om lag samme kostnad. Ved lavere effort leverer Astra eller Sol tilsvarende kvalitet billigere. Low, medium og high ligger bak Sols high, xhigh og max på intelligence mot tokens.
Hullet mot Opus er fakta og vitenskap. AA-Omniscience: 54 prosent fakta mot 66, men lavere hallusinasjonsrate, 47 mot 59. Humanity’s Last Exam og SciCode ligger om lag seks poeng bak. Terminal-Bench-Science, som ikke inngår i indeksen: 53 prosent, bak Astra og Opus.
Fem effort-nivåer: low, medium, high, xhigh, max. Fallback på om lag 0,1 prosent av oppgavene, primært Terminal-Bench 4.0, alltid ned til Sonnet 5. Kontekstvindu 1 million tokens, uendret. Cache-skriv 2,50 dollar, cache-les 0,20.
Pre-release, Copilot og Cursor
Tallene er kjørt på en pre-release. Anthropic fant en feil som kan svekke svar med strukturert output. Feilen er rettet i den offentlige versjonen. AA venter minimal endring eller svakt underdrevet score, og skal kjøre relevante tester om igjen.
GitHub tok modellen inn i Copilot samme dag, GA for Pro, Pro+, Max, Business og Enterprise. Tidlige GitHub-tester: matcher Sonnet 5 på koding, færre steg, tokens og verktøykall, ferdig raskere. Faktureres til leverandørens listepris. Enterprise- og Business-admin styrer tilgang. Nye modeller er på som standard med mindre global default er av.
Cursor dokumenterer 55,5 prosent på CursorBench ved max, nest etter Opus 5.5, samme tokenpris som Sonnet 5. Low effort 35,8 prosent. Max koster om lag seks ganger high per oppgave der. I desktop-appen rutes Sonnet 5.5-subagenter foreløpig til Auto, ifølge Cursors eget forum 28. september. CLI og Cloud Agents er ikke rammet.
Hva styret bør gjøre
Ikke bytt default til max fordi indeksen viser 56. Max er nær Opus på kunnskap og terminal, og dyrest AA har sett. High er settingen som nærmer seg Sol på pris og kvalitet. Low og medium taper mot Sol.
Ikke bruk Anthropics 30 prosent billigere som SLA. Det er labens gjennomsnitt over «de fleste oppgaver». AA-indeksen ved max viser 50 prosent dyrere. Mål kostnad per ferdig oppgave i deres egen harness, med den effort dere faktisk vil tillate.
CISO: fallback 0,1 prosent til Sonnet 5. Det er sjelden. Det er også første Sonnet med cyber-sperrer på Opus-nivå, allerede dekket i Anthropics systemkort. AA-indeksen her er ikke Cyber Index.
Haiku 5.5 er ikke i denne målingen. Den kommer «i ukene som kommer».
Kilder og medier
Primærkilde: Artificial Analysis, «Claude Sonnet 5.5 reaches #2 on the Artificial Analysis Intelligence Index», 28. september 2026. https://artificialanalysis.ai/articles/claude-sonnet-5-5 GitHub Changelog, Claude Sonnet 5.5 in GitHub Copilot, 28. september 2026. Cursor-dokumentasjon for Claude Sonnet 5.5. Thumbnail: OpenAI Image 2 / hogby.ai
📬 Likte du denne?
AI-nyheter for ledere. Kuratert av en CIO som bygger det selv. Daglig i innboksen.