Interessen er især rettet mod bøger udgivet før 2022. De indeholder tekst skrevet af mennesker og kan derfor være attraktive som træningsdata, der ikke allerede er blandet med tidligere AI-genereret indhold .
Den hollandske antikvarboghandler Pieter de Vries fra De Vries & De Vries i Haarlem modtog en e-mail fra en person, der kaldte sig Natalia eller Nataly. Hun skrev på vegne af det Singapore-baserede firma 2077AI.
Meddelelsen indeholdt et regneark med mere end 3.000 ISBN-numre. Listen bestod hovedsageligt af smalle akademiske og obskure titler. De Vries blev bedt om at finde bøgerne, udarbejde tilbud og beregne fragt til Kina .
Han afviste i første omgang henvendelsen som spam eller phishing. Senere viste det sig, at lignende forespørgsler var nået frem til brugtboghandlere i blandt andet Nederlandene, Tyskland, Schweiz og Spanien. Handlerne blev af nogle forhandlere sat i forbindelse med AI-laboratorier i USA .
Retsdokumenter, der blev offentliggjort i sagen Bartz v. Anthropic, viser, at Anthropic fra begyndelsen af 2024 arbejdede på en hemmelig operation kaldet Project Panama .
Ifølge dokumenterne brugte virksomheden titusinder af millioner dollar på at købe millioner af fysiske bøger. Bøgerne blev skåret op, hver side blev scannet, og de fysiske originaler blev ødelagt. Formålet var at opbygge et privat træningskorpus af høj kvalitet til chatbotten Claude .
Et internt planlægningsdokument fra 2024, som blev offentliggjort i januar 2026, beskrev projektet med ordene: “Project Panama is our effort to destructively scan all the books in the world” – altså: “Project Panama er vores forsøg på at scanne alle verdens bøger destruktivt” .
Målet var ifølge materialet at behandle op mod 2 millioner bøger på seks måneder . Mere end 4.000 sider fra retssagen beskriver projektets omfang .
Den 23. juni 2025 afsagde den amerikanske distriktsdommer William Alsup fra Northern District of California en central kendelse i Bartz v. Anthropic.
Han fandt, at brugen af bøger til AI-træning var “quintessentially transformative” – på dansk omtrent “grundlæggende transformerende” – og derfor omfattet af doktrinen om fair use i amerikansk ophavsret .
Kendelsen indebar, at en AI-virksomhed som udgangspunkt kunne købe bøger lovligt, digitalisere dem og bruge materialet til træning. Dommeren accepterede også, at de købte papirbøger blev erstattet af søgbare digitale kopier .
Der var dog en vigtig grænse: Dommeren afviste, at piratkopierede bøger automatisk kunne behandles på samme måde. Download af bøger fra piratsider blev ikke anset for fair use .
I juli 2026 godkendte en føderal dommer i San Francisco et forlig på 1,5 milliarder dollar i det kollektive søgsmål mod Anthropic. Sagen var anlagt af forfattere, blandt andre Andrea Bartz og Charles Graeber .
Forliget kom efter kendelsen fra juni 2025. Den havde fastslået, at træning på lovligt erhvervede bøger kunne være lovlig, men sagen omfattede også beskyldninger om brug af piratkopieret materiale . Dommen var derfor ikke en generel accept af alle former for AI-træning på ophavsretligt beskyttede værker.
Sagen peger på fremkomsten af et sekundært marked for bøger, der indkøbes specifikt som træningsdata til store sprogmodeller – ofte forkortet LLM’er.
AI-virksomheder bruger ifølge rapporterne tredjepartsformidlere til at skjule den endelige købers identitet. Blandt de nævnte aktører er ISBN-databaseselskabet ISBNdb, som kan bruges til at placere store, anonyme ordrer på hundredtusinder af bøger .
Bøgerne sendes videre til forskellige knudepunkter, blandt andet i Kina eller andre behandlingscentre, hvor de kan blive skåret op og scannet . For boghandleren kan ordren ligne en almindelig engroshandel. Forskellen er, at bogen ikke skal læses eller samles – den skal udnyttes som datakilde.
Arkivarer, bibliotekarer og forhandlere af sjældne bøger frygter, at de sidste fysiske eksemplarer af sjældne eller udsolgte akademiske værker bliver ødelagt permanent .
Der findes også ikke-destruktive metoder. Eksempelvis kan specialscannere som Treventus ScanRobot digitalisere skrøbelige bøger uden at beskadige dem og ifølge de omtalte kilder behandle op til 2.500 sider i timen. Men den type scanning er dyrere og langsommere i stor skala .
Når ryggen først er skåret af, og papiret er blevet makuleret, er der ikke nødvendigvis længere en fysisk kopi tilbage. For smalle fagbøger, hvor kun få eksemplarer er kendt, kan det betyde et uigenkaldeligt tab for forskning, samlere og kulturarv .
Det centrale spørgsmål er derfor ikke kun, om destruktiv scanning er lovlig i bestemte situationer. Det handler også om, hvem der har ret til at beslutte, at en bogs fysiske form kan ofres for at gøre indholdet til en privat ressource for kunstig intelligens.