OpenAI Defense Factory: 250 i intern sprint – Codex fikser, mennesket merger
OpenAI varslet 9. september at de har kjørt en intern sikkerhetssprint med mer enn 250 personer over hundrevis av systemer. De nyeste cybermodellene, sammen med Codex, fant og hjalp til med å rette sårbarheter selskapet sier de ellers kanskje ikke hadde oppdaget. Det de publiserer, er arkitektur, lærdom og en playbook for det de kaller en Defense Factory: en kontinuerlig sløyfe der AI-agenter finner sårbarheter, validerer dem og sjekker at fiksene virker.
For en CISO er dette ikke en modell-lansering. Det er OpenAI som tar Critical-klasse cyberkapabilitet, som de selv har lagt på GPT-6 Astra, og bruker den mot egne systemer. Daybreak Blue og Daybreak Red står som sikkerhetsmodeller. Astra, Sol, Terra og Luna som generell motor. Codex Desktop, Codex CLI og Codex Security CLI som harness.
Hva som faktisk er nytt
Sidene på openai.com/the-defense-factory beskriver en intern «code red». Thibault Sottiaux, sjef for kjerneprodukter og plattform, sier de styrker forsvaret med samme hast som en hendelse, og at arbeidet går foran alt unntatt kritisk drift. Sprinten dekket mer enn 100 tjenesteområder.
OpenAI peker på tre trekk de mener endrer forsvaret: åpne vekter som angripere kan misbruke, agenter som husker på tvers av økter, og flåter av langvarige agenter som kan utnytte svakheter før et menneske rekker å patche. Forsvarernes fortrinn, skriver de, er tilgang til egen kode og til frontier-modeller. Det vinduet kaller de defender's window.
Cloudflare, Ramp og Google er sitert som miljøer som også utforsker tilnærmingen. Ramp-tallet i playbooken er om lag 100 saker rettet på seks dager, med mennesker som reviewer PR-er. Det er deres case, ikke hogby.ai-verifisering.
Tallene OpenAI selv oppgir
Disse er leverandørens egne målinger fra sprinten, ikke uavhengig audit.
53 haste- eller høyprioritetssaker ble stengt første dag, før inventar og eierskap var ferdig. Etter at agenter begynte å rute saker, ble 90,6 prosent av eierskapet akseptert. 37 prosent av funnene ble merket som duplikater; de stoppet ruting til dedupliseringen ble bedre. 19,5 prosent av funnene ble reprodusert i runtime. Falske positiver etter dynamisk validering: 0,81 prosent. Tilbakerullede fiks: 0,53 prosent. Remediering var 100 prosent Codex-basert. Agenter skrev patcher. Mennesker reviewet.
19,5 prosent runtime-reproduksjon er tallet som bør styre forventningene. Resten er støy, duplikater eller funn som ikke lot seg kjøre i testmiljøet. OpenAI innrømmer at oppsett av isolerte miljøer ble flaskehals.
Arkitekturen, ikke produktet
En Defense Factory er ifølge OpenAI limet mellom verktøy dere allerede har: GitHub eller GitLab, Snyk, Semgrep, Tenable, Jira, Linear og ServiceNow. Kontrollplanet orkestrerer last, policy og hemmeligheter via en credential-proxy. Dataplanet er kortlivede, isolerte utviklingsmiljøer der agenter reproduserer funn og tester fiks. Overvåking av agenter som kjører cybermodeller er eget lag.
Sløyfen har fem steg: inventar, oppdagelse, dynamisk validering, eierskap og verifisert remediering. SECURITY.md er delt kontekst, ikke et sjette steg. Fikser som var merget, men ikke rullet ut, ga et gap. De utvidet verifikasjon og lot automatisk gjenåpning stå av.
Codex Security-pluginen er den konkrete inngangen for kunder. Daybreak krever søknad for autorisert forsvarsarbeid. OpenAI skriver at teknisk blogg kommer. Playbooken ligger som PDF.
Hva dette ikke er
Det er ikke en ny vektfil. Det er ikke en SLA. Det er ikke en ferdig SOC du kan kjøpe. En 250-personers intern sprint hos laben som eier modellene, er ikke en mal for et norsk sikkerhetsteam på åtte personer. Agenter som scanner og patcher, trenger stramme merge-kontroller, isolasjon og logging. OpenAI sier selv at autonomi må bygges trinnvis fra manuelle steg.
Astra er allerede klassifisert som Critical på cyber i OpenAIs eget rammeverk. Defense Factory er deres svar på at den klassen nå finnes både hos dem og, med forsinkelse, hos angripere som bruker åpne vekter. Hugging Face-hendelsen i juli, der evalueringsmodeller kom ut av kontroller, er eksplisitt bakteppe.
Hva ledere bør gjøre nå
- Skill Daybreak fra Astra i ChatGPT. Cybermodeller til autorisert forsvar er et tilgangs- og loggspørsmål, ikke en Plus-funksjon.
- Ikke slipp Codex Security mot produksjon uten isolerte miljøer, credential-proxy og menneskelig merge.
- Mål reproduksjonsrate og falske positiver på eget kodeverk. OpenAIs 19,5 og 0,81 prosent er deres sprint, ikke deres baseline.
- Krev eierskap per tjeneste før agentene får rute saker. Uten inventar blir det støy.
- Behandle playbooken som arkitekturreferanse, ikke innkjøpsgrunnlag.
Kilder og medier
Primærkilde: OpenAI, «Defense Factory»: https://openai.com/the-defense-factory/
OpenAI, Defense Factory playbook (PDF): https://cdn.openai.com/defense-factory/downloads/defense-factory-playbook.pdf
Offisiell kunngjøring: OpenAI på X, 9. september 2026: https://x.com/OpenAI/status/2097786616311840853
Thumbnail: OpenAI Image 2 / hogby.ai
📬 Likte du denne?
AI-nyheter for ledere. Kuratert av en CIO som bygger det selv. Daglig i innboksen.