Microsoft kalte AI-skraping tyveri: Copilot kuttet NYT-klikk 93 prosent
Microsoft-direktør Brent Hecht kalte intern skraping av nyheter «historiens største tyveri av arbeid». Samtidig viser Microsofts egne tall at Copilot-svarmotoren kuttet klikk til The New York Times med inntil 93 prosent mot vanlig Bing-søk.
Det er kjernen i nye, avforseglede sitater i opphavsrettssaken Times og andre utgivere har reist mot OpenAI og Microsoft. TechCrunch og Ars Technica har gått gjennom dokumentene som ble synlige 17. september. Reuters og Times bekrefter samme spor.
Hva som kom frem
Saken er tre år gammel. Det nye er ikke at utgivere saksøker. Det nye er at interne notater, presentasjoner og vitnemål nå ligger åpent nok til at et styre kan lese hvordan labene selv beskrev produktet.
TechCrunch understreker et viktig forbehold: mye av det nye kommer fra Times' eget prosesskriv, ikke fra de underliggende bilagene som fortsatt er forseglet. Sitatene under er derfor slik utgiverne gjengir dem, uten original kontekst rundt hvert enkelt notat.
Mønsteret er likevel tett, og det er korroborert av flere redaksjoner.
I et internt Microsoft-notat fra januar 2023 kalte Hecht, da director of Applied Science, skrapingen «an astonishing theft of unprecedented proportions» og «the largest theft of labor in human history». Ifølge Ars Technica skrev han i et annet dokument at planen om å skrape nyheter i stor skala gjorde «a complete mockery of the idea of fair use».
Microsofts egne data, ifølge TechCrunch, viser at Copilot-svarmotoren kuttet klikkrate til nytimes.com med inntil 93 prosent mot tradisjonelt Bing-søk. Ars Technica gjengir 83–93 prosent fall for noen saksøkere og 51–94 prosent for andre.
En intern Microsoft-presentasjon fra januar 2024, skrevet av Hecht, kalte fallet en «doom loop» som ville «hurt the performance of our models and the entire web at the same time». Samme dokument slår fast at det er uvanlig at et sluttprodukt truer det økonomiske grunnlaget til sine egne leverandører, men at det er situasjonen Microsoft har skapt for LLM-virksomheten og dens innholdskjede.
OpenAI-sjef for ChatGPT, Nick Turley, skrev internt at utgivere står overfor en «existential threat» fra produkter som er «largely substitutive» og som blir mer substituerende jo bedre de blir. Ars gjengir ham også på formuleringen «largely substitutive, period». En OpenAI-ingeniør skrev at brukerne ikke klikker «no matter how prominently we show the links».
OpenAI-president Greg Brockman beskrev modellene som «excellent at news». Da forsker Nick Ryder fortalte ham om en «hack to get around nytimes paywall», svarte Brockman «ah nice», ifølge dokumentene.
Microsoft-sjef Satya Nadella vitnet under ed i år at alt som ligger bak betalingsmur, bør lisensieres for grounding eller trening. Hvis han hadde visst at OpenAI hadde trent på slikt innhold, ville han ha brukt Microsofts rett til å kreve at modellene ble trent på nytt. Han erkjente også at samtaler med chatboter har substituert nettsteder: informasjonen kommer på AI-plattformen i stedet for at brukeren går til kilden.
Omfanget er stort. Mid-treningssettene alene skal inneholde mer enn 91 692 kopier av verk fra Times, Daily News og Center for Investigative Reporting. Et datasett avledet av Common Crawl skal ha mer enn to millioner dokumenter fra nytimes.com. OpenAI leverte hele GPT-3-treningssettet til Microsoft. Microsoft leverte treningsdata tilbake via tiltak kalt Project Taxi og Project Mango. Mango-settet skal inneholde kopier av minst 160 903 unike verk fra nyhetsutgiverne.
Ansatte skal ha fjernet copyright-merknader fra treningsdata fordi de ikke ville at modellen skulle skrive dem ut til brukere. Ifølge Ars skal OpenAI ha hentet et Times-sett med 1,8 millioner artikler fra en tredjepart bundet av avtale om at dataene ikke skulle brukes kommersielt. Ansatte visste at det «would not be appropriate» å trene en modell på dem, men gjorde det likevel, hevder utgiverne. Microsoft skal dessuten ha solgt et datasett kjøpt for Bing som treningsdata til OpenAI uten å spørre nyhetsorganisasjoner som hadde samtykket til vanlig søkekrypning, ikke til modelltrening.
Utgiverne beskriver også et filter som Hecht skal ha advart kunne oppfattes som en «accidental cover up», fordi rettighetshavere da fikk dårligere innsyn i hva som gikk inn i treningen.
Hva Microsoft og OpenAI sier
OpenAI svarte ikke TechCrunch. Ars Technica fikk heller ikke umiddelbart svar fra OpenAI.
Microsoft avviser at Hechts formuleringer er selskapets syn. En talsperson sa til Ars at dokumentene «reflect one employee's individual perspective, are not a legal analysis, and do not represent the company's views». Om Nadellas vitnemål sa Microsoft at det var observasjoner om hvordan folk finner informasjon, ikke konklusjoner om opphavsrettsspørsmålet for retten. Selskapet holder fast ved at produktene er transformativ fair use og ikke erstatter nyhetssider.
Steven Lieberman, advokat for New York Daily News, sa det motsatte: evidensen viser for første gang at OpenAI og Microsoft visste at det de gjorde var galt.
Tidligere i september gikk Trump-administrasjonen inn i saken på labsiden og argumenterte for at trening på nyhetsinnhold er fair use. Det nye 17. september er ikke den politiske linjen. Det er labs interne språk om substitusjon, betalingsmur og klikkfall.
Hva dette betyr for norske ledere
For et norsk styre, CIO, CISO og juridisk direktør er dette ikke en amerikansk mediesak. Det er leverandørstyring.
Copilot sitter allerede i Microsoft 365-avtaler. ChatGPT sitter i pilotene. Begge produktene er bygget på en innholdskjede som labs selv har beskrevet som truet. Når Microsofts egne folk skriver «doom loop», er treningsdata, lisens og kildekvalitet driftsrisiko, ikke bare PR.
Tre konsekvenser er konkrete.
Kontrakt. Spør Microsoft og OpenAI skriftlig om modellene i deres tenant er trent på innhold bak betalingsmur, om de har lisens, og hva som skjer hvis en domstol krever omskolering. Nadella har selv sagt at omskolering er verktøyet. Det bør stå i avtale, ikke i et vitnemål.
Substitusjon mot egne kilder. Hvis Copilot og ChatGPT erstatter klikk til fagstoff, analyseabonnement og intern dokumentasjon på samme måte som de erstatter nyhetssider, får dere et sporbarhetsproblem. Svar uten kilde er ikke et vedtak. Krev logging av kilder, sitering og når svaret er oppsummert fra opphavsrettsbeskyttet materiale.
EU og Norge. Amerikansk fair use er ikke EØS-rett. DSM-direktivet, opphavsrett og AI Act-krav om treningsdata peker i en annen retning enn Justisdepartementet i Washington. Ikke anta at en amerikansk seier for labene automatisk dekker europeisk bruk, innkjøp eller erstatningsansvar.
CISO-sporet er like konkret. Saksdokumentene beskriver circumvention av betalingsmur, stripping av copyright-merknader og gjenbruk av søkeindeksdata til trening. Det er samme klasse spørsmål som robots.txt, vilkår og databehandleravtaler. Hvis en leverandør kan omgå en betalingsmur i treningsløpet, skal det inn i leverandørrevisjonen.
Hva dere bør gjøre denne uken
Be juridisk og innkjøp om en tosiders briefing: treningsdata, lisens, substitusjon og omskolering i gjeldende Microsoft- og OpenAI-avtaler.
Stopp antakelsen om at «offentlig på nett» er det samme som «lovlig å trene på».
Kartlegg hvor Copilot og ChatGPT brukes som erstatning for nyhetstjenester, analyseabonnement og interne kunnskapskilder.
Ikke vent på en endelig amerikansk dom. Kontraktene kan skrives om nå.
Dette er ikke et vedtak om at labene taper. Det er et vedtak om at de visste risikoen, målte klikkfallet og fortsatte. For et styre er det nok til å flytte opphavsrett fra kommunikasjonsavdelingen til leverandørstyring.
Kilder og medier
Kilde: TechCrunch, «Microsoft exec called AI scraping ‘the largest theft of labor in human history,’ new unredacted filings reveal», publisert 17. september 2026 kl. 19:46 UTC. https://techcrunch.com/2026/09/17/microsoft-exec-called-ai-scraping-the-largest-theft-of-labor-in-human-history-new-unredacted-filings-reveal/
Supplerende: Ars Technica, «Microsoft exec called AI scraping the “largest theft of labor in human history”», 17. september 2026. https://arstechnica.com/tech-policy/2026/09/microsoft-exec-called-ai-scraping-the-largest-theft-of-labor-in-human-history/
Supplerende: Reuters, «OpenAI, Microsoft executives' quotes on AI training threaten copyright defense, news outlets argue», 17. september 2026. https://www.reuters.com/business/media-telecom/openai-microsoft-executives-quotes-ai-training-threaten-copyright-defense-news-2026-09-17/
Supplerende: The New York Times, «Microsoft and OpenAI Workers Worry About ‘Largest Theft of Labor’ in History», 17. september 2026. https://www.nytimes.com/2026/09/17/technology/microsoft-openai-publishing-industry.html
Thumbnail: OpenAI Image 2 / hogby.ai
📬 Likte du denne?
AI-nyheter for ledere. Kuratert av en CIO som bygger det selv. Daglig i innboksen.