OpenAI og Microsoft innrømmer innholds-tyveri og «doom loop»

Microsoft kaller treningsmaterialet for «det største tyveriet av arbeidskraft i menneskehetens historie», avslører dokumenter. Nå kan tyveriet grave deres egen grav.

Spør du ChatGPT om gode burgere, smaker ikke ChatGPT seg fram til svaret på egenhånd. Innholdet må komme fra et sted, blant annet medier.
Publisert

Avisa The New York Times har en rettssak gående mot OpenAI og Microsoft, som avisa mener har stjålet artiklene deres for å trene opp språkmodellene sine. 

Språkmodeller som direkte skader trafikken og inntektene til avisa, når folk heller spør KI enn å lese avisa selv. Hele mediebransjen, i både USA og Norge, opplever nå langt mindre trafikk fra blant annet Google. 

I dokumenter som har blitt sluppet i rettsprosessen får vi innblikk i intern kommunikasjon i selskapene. Som langt på vei viser at KI-gigantene er fullstendig klar over at de stjeler innhold i svimlende skala, omgår betalingsmurer og potensielt graver sin egen grav

For KI-løsningene deres er en eksistensiell trussel mot innholdet de trener på.

«Doom loop»

Dokumentene, som er omtalt og delt av blant annet Ars Technica, inneholder oppsiktsvekkende sitater fra både ansatte og sjefer i Microsoft og OpenAI. 

  • Microsofts «director of Applied Science», Brent Hecht, kaller treningsmaterialet deres for «et oppsiktsvekkende tyveri av uhørte proposjoner», og «det største tyveriet av arbeidskraft i menneskehetens historie». 

  • OpenAIs ChatGPT-sjef Nick Turley mener mediene de tar innholdet fra møter en «eksistensiell trussel» fra KI-tjenestene.  

  • I et dokument hos Microsoft skriver selskapet at «vår innholdsstrategi har starta en "doom loop" som vil skade ytelsen til våre modeller og hele webben samtidig». Fordi mediene de trener KI-en på får mindre trafikk, tjener mindre penger, skaper mindre innhold, og dermed gir mindre treningsdata for KI.  

  • Samme dokument påpeker at «det er veldig uvanlig at sluttproduktet truer det økonomiske fundamentet for sin viktigste leverandør, men det er situasjonen vi har laget». 

Dokumentene fra rettssaken tegner et ganske annet bilde av hva KI-gigantene egentlig mener om treningsdataen sin.

Omgår betaling, skaper ikke klikk

At KI-selskapene har skrapet til seg praktisk talt alt innhold på internett er ikke noe nytt. Og skrapingen etter nytt innhold fortsetter, hver eneste dag. KI-gigantenes syn er at dette er «fair use», som de kaller det i USA. 

Men dokumentene viser at også innad i KI-selskapene er dette omstridt. ChatGPT-sjef Turley uttaler at å forsvare seg med «fair use» vil «gjøre fullstendig narr av konseptet». 

Dessuten kommer det også fram at selskapene jobber aktivt for å komme seg forbi betalingsmurene til avisene de skraper. Da en utvikler hos OpenAI fortalte direktør Nick Ryder at han hadde funnet en vei om The New York Times sin betalingsmur, svarer Ryder: «Ah, nice». 

Det er også gjennomgående at KI-selskapene er fullstendig klar over at produktene deres skaper lite menneskelig trafikk tilbake til mediene. En utvikler klager på at «uansett hvor stort vi viser lenkene, vil ikke brukerne klikke». Og Turley uttaler at det «ikke finnes noen gode grunner til å klikke» når produktet deres allerede gir svaret brukeren er ute etter. 

Foretrekk oss i Google Discover

Ved å legge oss til som foretrukket kilde i Google vil du blant annet få opp flere av sakene våre i Google Discover. Tusen takk for støtten!

Foretrekk oss 😻
Bygget med Labrador CMS