Syarikat AI dikatakan menyasarkan buku yang diterbitkan sebelum 2022 kerana kandungannya dianggap lebih berkemungkinan ditulis sepenuhnya oleh manusia, tanpa campuran teks yang dijana AI sebelum ini .
Petunjuk tentang pasaran pembelian buku ini muncul daripada Pieter de Vries, penjual buku antik di De Vries & De Vries, Haarlem, Belanda.
De Vries menerima e-mel daripada seseorang yang memperkenalkan dirinya sebagai “Natalia” atau “Nataly” daripada syarikat 2077AI yang berpangkalan di Singapura. E-mel itu disertakan hamparan elektronik dengan lebih 3,000 nombor ISBN—kebanyakannya judul akademik khusus dan buku yang tidak begitu dikenali.
Pengirim meminta De Vries mendapatkan judul berkenaan, menyediakan sebut harga dan menganggarkan kos penghantaran ke China . Pada mulanya, beliau menganggap mesej itu spam atau cubaan phishing.
Permintaan hampir sama kemudiannya dilaporkan oleh penjual buku terpakai di Belanda, Jerman, Switzerland dan Sepanyol. Mereka mengesyaki buku-buku tersebut akhirnya disalurkan kepada makmal AI di Amerika Syarikat .
Dokumen mahkamah yang dibuka kepada umum dalam saman hak cipta Bartz v. Anthropic menunjukkan bahawa Anthropic memulakan Project Panama pada awal 2024 .
Menurut dokumen dan laporan berkaitan, syarikat itu membelanjakan puluhan juta dolar untuk membeli jutaan buku fizikal. Buku-buku tersebut dipotong tulang belakangnya, diimbas halaman demi halaman dan dimusnahkan bagi membina korpus latihan peribadi yang berkualiti tinggi untuk Claude .
Satu dokumen perancangan dalaman bertarikh 2024, yang didedahkan pada Januari 2026, menyifatkan projek itu sebagai: “usaha kami untuk mengimbas semua buku di dunia secara merosakkan” .
Cadangan vendor menunjukkan sasaran memproses antara 500,000 hingga 2 juta buku dalam tempoh enam bulan . Lebih 4,000 halaman dokumen mahkamah memberikan gambaran tentang skala operasi tersebut .
Pada 23 Jun 2025, Hakim Daerah Amerika Syarikat William Alsup dari Daerah Utara California memutuskan dalam kes Bartz v. Anthropic bahawa penggunaan buku yang diperoleh secara sah untuk melatih model AI merupakan penggunaan yang “amat transformatif” dan dilindungi doktrin fair use atau penggunaan wajar di bawah undang-undang hak cipta Amerika Syarikat .
Secara ringkas, keputusan itu membezakan dua perkara:
Keputusan ini terpakai di bawah undang-undang Amerika Syarikat dan tidak semestinya menyelesaikan persoalan hak cipta di negara lain. Ia juga tidak bermaksud semua bentuk penggunaan karya berhak cipta untuk latihan AI akan sentiasa dianggap sah.
Pada Julai 2026, hakim persekutuan di San Francisco meluluskan penyelesaian bernilai AS$1.5 bilion dalam tuntutan berkumpulan Bartz v. Anthropic. Kes itu dibawa oleh penulis, termasuk Andrea Bartz dan Charles Graeber, terhadap Anthropic .
Penyelesaian tersebut dibuat selepas keputusan Jun 2025 yang menganggap penggunaan buku yang dibeli secara sah sebagai penggunaan wajar. Namun, tuntutan dalam kes itu turut melibatkan penggunaan bahan cetak rompak—isu yang tidak mendapat perlindungan sama daripada keputusan mahkamah .
Justeru, keputusan mahkamah bukanlah kemenangan mutlak untuk Anthropic. Syarikat itu mendapat keputusan memihak berhubung latihan menggunakan bahan yang diperoleh secara sah, tetapi berdepan liabiliti dan tuntutan besar berkaitan salinan tidak sah.
Di sebalik permintaan pukal itu, muncul pasaran sekunder yang membekalkan buku khusus kepada latihan model bahasa besar atau LLM. Syarikat AI dilaporkan menggunakan perkhidmatan orang tengah pihak ketiga—termasuk syarikat pangkalan data ISBN ISBNdb—untuk membuat pesanan tanpa mendedahkan identiti pembeli akhir .
Kaedah itu membolehkan syarikat mendapatkan ratusan ribu buku sekali gus tanpa tampil secara terbuka sebagai pembeli. Penjual buku di beberapa negara Eropah melaporkan pertanyaan yang hampir serupa, manakala penghantaran dibuat ke hab pemprosesan seperti China atau lokasi lain yang mempunyai kemudahan pengimbasan .
Kesan paling merisaukan bukan sekadar soal hak cipta. Pengarkib, pustakawan dan penjual buku langka bimbang salinan terakhir bagi judul akademik yang jarang ditemui atau sudah tidak dicetak mungkin dimusnahkan untuk mendapatkan datanya .
Teknologi pengimbasan tanpa merosakkan—seperti Treventus ScanRobot—boleh mendigitalkan buku rapuh tanpa memusnahkannya, dengan kapasiti yang dilaporkan mencecah 2,500 halaman sejam. Namun, kaedah industri yang memotong dan mencincang buku lebih murah apabila digunakan pada skala besar .
Selepas sebuah judul diproses, tiada lagi naskhah fizikal yang terselamat daripada kelompok berkenaan. Bagi karya yang hanya mempunyai beberapa salinan diketahui, kehilangan itu bersifat kekal dan tidak boleh dipulihkan .
Persoalan yang ditinggalkan oleh Project Panama bukan hanya sama ada mesin boleh membaca buku lebih pantas. Ia juga tentang siapa yang memiliki pengetahuan selepas buku tersebut dimusnahkan—dan sama ada kemajuan AI patut dibayar dengan kehilangan sebahagian daripada rekod budaya dan ilmiah manusia.