OpenAI textGrain: ChatGPT i EU merkes – detektor stengt
OpenAI slår på tekstvannmerking 5. oktober. Teknologien heter textGrain. API-kunder kan slå den på globalt fra i dag. Den er av som standard. ChatGPT og Codex i EU får usynlig merking på berettiget tekst de neste ukene, på alle plan. Detektoren er ikke offentlig.
EU AI-forordningen krever at generert tekst kan identifiseres maskinlesbart. OpenAI innrømmer at vannmerking og deteksjon er tidlige teknologier med store begrensninger. De ruller ut regionalt for å lære. De gjør det ikke til global standard.
Hva som faktisk skjer
textGrain legger et statistisk signal i modellens ordvalg. Ingen synlige tegn. Ingen skjulte mellomrom. En detektor med samme nøkkel ser etter mønsteret. OpenAI sier de vil åpne kildekoden senere. En teknisk rapport ligger ute som PDF og skal oppdateres.
I egne tester matcher eller slår textGrain SynthID for tekst. Det er labs egne tall. Sterk ytelse under ideelle forhold er ikke det samme som pålitelig deteksjon i drift.
Ved mål om 1 prosent falske positive fant detektoren vannmerke i om lag 80 prosent av 200-token-passasjer, mot om lag 95 prosent av 400-token, på psykologi-innhold fra ELI5. Matematikk er vesentlig svakere. Der er det færre måter å si det samme på.
Redigering river signalet. På 400 tokens: 10 prosent synonymbytte kutter deteksjon fra om lag 92 til 66 prosent. 25 prosent bytte tar den ned til 17 prosent. Omskriving og oversettelse kan fjerne merket helt.
EU-kodeksen krever ikke vannmerke under 200 tokens, om lag 150 engelske ord, eller i kodesnutter. Kort svar og kode er altså unntatt, og vanskelig å merke uansett. Faktatekst og tekst som bare gjengir brukerens innhold gir også lite rom for signal.
Astra uten merkbart kvalitetstap
OpenAI måler Astra, deres nyeste frontmodell, med og uten vannmerke. Forskjellene er små:
Artificial Analysis Intelligence Index: 49,57 mot 49,76 poeng. AutomationBench: 34,09 mot 34,86 prosent. DeepSWE v1.1: 72,80 mot 71,68 prosent. Terminal-Bench 4.0: 53,90 mot 56,06 prosent. Terminal-Bench Science 0.1: 56,90 mot 60,00 prosent. BrowseComp: 87,92 mot 87,35 prosent. HealthBench Professional: 64,27 mot 64,60 prosent. GPQA Diamond: 94,44 mot 93,94 prosent.
Det er ikke et uavhengig lab-løp. Det er OpenAIs egne benchmarks. Poenget for CIO er at de ikke rapporterer et synlig kvalitetskutt på Astra.
Hva merket ikke sier
Et treff betyr at et OpenAI-system sannsynligvis genererte eller bearbeidet deler av teksten. Det sier ikke hvor mye et menneske redigerte. Det etablerer ikke eierskap, lovlighet eller ansvar. Det identifiserer ikke person, organisasjon, konto, prompt eller samtale. Det sier ingenting om sannhet.
Fravær av merke beviser ikke menneskelig forfatterskap. Teksten kan være for kort, redigert, oversatt, fra en umerket modell, eldre enn ordningen, eller fra en annen leverandør.
Språk varierer. På 24 offisielle EU-språk, 1 prosent falske positive: spansk 69,0 prosent, rumensk 42,2 prosent. De kan skru opp styrken der deteksjonen ligger under 60 prosent. Norsk er ikke offisielt EU-språk. Utrullingen av ChatGPT og Codex er EU, ikke EØS automatisk.
Hva leder bør gjøre
ChatGPT og Codex i EU blir merket. API forblir av som standard. Det er bevisst. Dere velger selv om API-trafikk skal merkes, per prosjekt eller organisasjon. Sky-partnere skal få samme mulighet de neste ukene.
Detektoren åpnes bare for godkjente forskere og ekspertorganisasjoner, sak for sak, under EU-kodeksen for åpenhet om AI-generert innhold. Cornell, ETH Zürich/INSAIT og KInIT er tidlige partnere. Dette er ikke et HR-verktøy dere kan kjøpe for å sjekke ansatte. openai.com/verify og Content Provenance API fortsetter å være offentlige for bilde og lyd, ikke for tekst ved lansering.
For CISO: ikke bygg policy på at umerket tekst er menneskelig. Ikke anta at merket overlever parafrasering. Ikke anta at kode og korte svar er merket. Hvis dere leverer AI-generert tekst til EU-brukere via API, er opt-in et compliance-valg, ikke en teknisk garanti.
Norge er ikke EU. Merkingen av ChatGPT og Codex gjelder EU. Norske selskaper med EU-ansatte, EU-kunder eller EU-databehandling må likevel ta stilling til API-bryteren og til hvordan de dokumenterer AI-bruk.
Bilde og lyd fortsetter med C2PA og SynthID. Tekst er det svake leddet, og OpenAI sier det rett ut.
Kilder og medier
Primærkilde: OpenAI, «Our approach to EU text provenance rules», 5. oktober 2026: https://openai.com/index/eu-text-provenance/
Hjelpesenter og teknisk rapport er sitert derfra. Thumbnail: OpenAI Image 2 / hogby.ai
📬 Likte du denne?
AI-nyheter for ledere. Kuratert av en CIO som bygger det selv. Daglig i innboksen.