Hopp til hovedinnhold
 AI-nyheter, ferdig filtrert for ledere
SISTE:

SoftBank: 10 mrd. dollar i junk-papir – OpenAI-tranche 1. oktober • OpenAI-agenter rammet RubyGems: over 2000 pakker – kalt godartet • Anthropic: Claude-bruddene var alignment-feil, ikke bare sandbox • Dommer river Pentagons Anthropic-svartelisting – kaller den grunnløs

Cognition Fusion: Fable holder – Astra faller 5,6 poeng på Terminal-Bench
CognitionDevin FusionSWE-2Fable 5.1GPT-6 AstraAI-modellerKodeagenterCIOCISOFinOps

Cognition Fusion: Fable holder – Astra faller 5,6 poeng på Terminal-Bench

JH
Joachim Høgby
11. september 202611. september 20265 min lesingKilde: Cognition

Cognition åpnet 11. september Fusion i Devin Desktop og CLI: en harness der en frontier-modell planlegger og reviderer, mens SWE-2 utfører. Selskapet kaller det den mest effektive frontier-harnessen for Anthropics Fable 5.1 og OpenAIs GPT-6 Astra, «opptil 39 prosent mer effektiv» enn andre harnesser på store kodebenchmarks.

Det er ikke en ny modell. SWE-2 kom dagen før, uten frittstående API og uten åpne vekter. Fusion er produktet som skal gjøre den billige sidekicken lønnsom. For en CIO er spørsmålet om Pareto-kurven holder utenfor Cogs tabell, og om to modeller i samme agentøkt er styring eller ny angrepsflate.

Hva Fusion faktisk gjør

Brukeren velger to modeller, ikke én. Lead eier sesjonen: plan, tvetydighet og review. Sidekick får en brief med rammer og suksesskriterier, utforsker koden, implementerer, kjører tester og rapporterer tilbake. De to agentene har hver sin persistente kontekst og verktøy. De utveksler brief, resultat og tilbakemelding, ikke hele samtalen. Prompt-cachen beholdes.

Cognition avviser enkel modellruting. Etter selskapets egen fordeling på FrontierCode går 32 prosent av turene til plan, 34 til setup, 5 til implementasjon, 17 til debug, 9 til validering og resten til avslutning. Første prompt sier ikke om «fiks xyz» er én linje eller en ombygging. Midt-i-oppgave-bytte knuser cachen og koster frontier-tokens. Fusion holder lead i førersetet hele veien og lar den ta tilbake kontrollen når sidekicken er utenfor dybden.

Anbefalt par er Fable 5.1 pluss SWE-2. Astra kan også lede. Dokumentasjonen sier Fusion ligger på betalte planer i Devin CLI 3000.10.20+ og Desktop 3.10.0+, ikke på gratis eller prøve. Hver modell faktureres til egen tokenpris. På Cognition-plattformen meteres bruk i ACU.

Tallene, med hullene

Cognition oppgir at de har evaluert sammen med Artificial Analysis og Vals AI. Tabellen under er deres. Den er nyttig, men det er fortsatt leverandørens utvalg av harness, innsatsnivå og oppgavesett.

På DeepSWE 1.1 går Fable 5.1 alene 64,3 poeng til 14,63 dollar. Fusion med Fable og SWE-2: 63,1 poeng til 7,88 dollar, minus 46 prosent. Astra alene 67,6 til 7,88 dollar. Fusion med Astra: 67,3 til 4,69 dollar, minus 40 prosent. Scoretapet er minimalt, kostnaden halveres nesten.

Terminal-Bench 4 er den harde raden. Fable 57,6 til 17,46 dollar mot Fusion 56,1 til 13,37, minus 23 prosent. Astra 55,6 til 10,08 mot Fusion 50,0 til 6,06, minus 40 prosent. Der faller Astra-paret 5,6 poeng. Det er ikke «samme kvalitet, lavere pris». Det er en synlig kvalitetskostnad på den oppgavetypen SWE-2 allerede tapte mot Fable og Astra da modellen ble sluppet 10. september.

SWE-Atlas QnA: Fable-Fusion 65,9 mot 64,8, billigere. Astra-Fusion 59,4 mot 61,8. Vals Code Migration: Fable-Fusion stiger fra 54,6 til 57,3 og kutter 41 prosent. Astra-Fusion faller fra 67,7 til 61,3, minus 20 prosent i kostnad. FrontierCode 1.1 Extended er flat: Fable 63,6 mot 63,5, Astra 63,1 mot 63,4, med 38 og 11 prosent lavere kostnad.

På Artificial Analysis Coding Agent Index v1.5, slik Cognition siterer det på produktsiden, står Claude Code med Fable 5.1 på 62,2 poeng og 12,36 dollar per kjøring. Devin Fusion med Fable 5.1 og SWE-2: 61,7 poeng og 7,90 dollar. Codex med Astra 6: 61,6 og 7,47 dollar. «39 prosent» er mot andre harnesser på denne indeksen, ikke en garanti i din pipeline.

Ett funn er mer interessant enn prosentene. SWE-2 medium koster 0,75 dollar per million tokens, GPT-5.6 Luna 0,20. Likevel blir Astra-Fusion med SWE-2 63,4 poeng til 2,34 dollar på FrontierCode, mot Luna 62,0 til 2,39. Dyrere sidekick, billigere oppgave. Cognition skriver at modell og harness i 2026 skal måles i pris per oppgave, ikke pris per token. Det er riktig som styringsregel. Det er også en argumentasjon for å holde deg i deres harness.

Hva det betyr for ledergruppen

GitHub har allerede HydraFusion i Copilot: frontier-kvalitet via flere modeller, med påstand om 67 prosent lavere kostnad. Mønsteret er det samme. Forskjellen er at Cognition låser sidekicken til SWE-2 inne i Devin, uten API. Du kjøper ikke en modell. Du kjøper et par, en harness og en fakturamodell.

FinOps: krev pris per merget PR og per mislykket kjøring, fordelt på lead og sidekick. Tokenpris alene lyver når Fable «koster dobbelt» per token men kan bli billigere per oppgave fordi den delegerer tidligere. Cogs eget eksempel: Fable som lead mot Opus 4.8, samme sidekick, 9 prosent lavere snittkostnad på FrontierCode.

CISO: to agenter med hver sin kontekst og verktøy betyr to spor å revidere. Lead skal lese sidekickens arbeid, men review er modell mot modell, ikke menneske mot diff. SWE-2 har ingen offentlig modellkort. Tilgangen er Devin. Sett krav om commit-signering, CI, hevede tester og menneskelig merge, samme bar som for Claude-skrevet produksjonskode.

Arkitektur: Fusion er tuned per par. Hvor detaljert lead briefer, om sidekicken får si imot, og hva som kan delegeres i utforskning, er harness-innstillinger, ikke noe du får «gratis» ved å peke to API-er mot hverandre. Bygger du dette selv, arver du Cogs forskningsproblem. Kjøper du Devin, arver du Cogs valg.

88 prosent av Cogs egne mergede PR-er skal ha gått gjennom Fusion-ruting. Det er intern statistikk, ikke en SLA. Be om de samme målene på deres repo, på Terminal-Bench-klasse oppgaver, før dere flytter budsjett fra enkeltmodell til par.

Kilder og medier

Primærkilde: Cognition, Introducing Fusion in Devin Desktop & CLI, 11. september 2026: https://cognition.com/blog/local-fusion

Cognition, Introducing SWE-2: https://cognition.com/blog/swe-2

Cognition, Fusion in Devin Desktop (dokumentasjon): https://docs.devin.ai/desktop/fusion

Devin CLI: https://devin.ai/cli

Thumbnail: OpenAI Image 2 / hogby.ai

📬 Likte du denne?

AI-nyheter for ledere. Kuratert av en CIO som bygger det selv. Daglig i innboksen.