كشفت وثائق قضائية نُشرت في يناير 2026 عن عملية داخل أنثروبيك تحمل الاسم الرمزي "مشروع بنما" بدأت في أوائل 2024 . وثيقة تخطيط داخلية ذكرت أن هدف المشروع هو: "مشروع بنما هو مسعانا لمسح جميع كتب العالم بشكل مدمر" . وأضافت الوثيقة نفسها، وفقًا لبوسطن غلوب: "لا نريد أن يُعرف أننا نعمل على هذا" .
هدفت العملية إلى مسح ما يصل إلى مليوني كتاب في حوالي ستة أشهر، من خلال التعاقد مع مزود خارجي . أنثروبيك أنفقت عشرات الملايين من الدولارات لشراء ملايين الكتب المطبوعة، وقطع فصوصها باستخدام آلة قطع هيدروليكية، ثم تشغيل الصفحات عبر ماسحات ضوئية عالية السرعة، ثم إرسال البقايا لإعادة التدوير . قاد المشروع توم هارفي (Tom Harvey)، مهندس سابق في جوجل بوكس (Google Books) . عروض الموردين المذكورة في الوثائق تشير إلى أن الشركة سعت للحصول على قدرة مسح تتراوح بين 500 ألف ومليوني مجلد . الرقم النهائي الدقيق لا يزال محجوبًا، لكن الوثائق تصفه بالملايين .
حكم الاستخدام العادل: حكم قاضي المحكمة الجزئية الأمريكية ويليام ألسوب (William Alsup) بأن المسح التدميري لأنثروبيك للكتب المطبوعة التي تم شراؤها قانونيًا يُشكل استخدامًا عادلاً بموجب قانون حقوق النشر. في حكمه الصادر في يونيو 2025، وصف ألسوب تدريب الذكاء الاصطناعي بأنه "تحويلي للغاية" (exceedingly transformative) وقارن العملية بـ"توفير المساحة" من خلال تحويل التنسيق . اعتمد الحكم على ثلاث حقائق: أنثروبيك اشترت الكتب بشكل قانوني، أتلفت كل نسخة بعد المسح، وأبقت الملفات الرقمية داخلية بدلاً من توزيعها .
تسوية بقيمة 1.5 مليار دولار: في 20 يوليو 2026، وافق قاضٍ فيدرالي على تسوية حقوق نشر بقيمة 1.5 مليار دولار تغطي الكتب المقرصنة التي حصلت عليها أنثروبيك واختزنتها دون تصريح — مسار منفصل عن برنامج مسح الكتب المطبوعة . كشفت القضية أنه قبل اللجوء إلى المشتريات القانونية، قام المؤسس المشارك لأنثروبيك بن مان (Ben Mann) بنفسه بتحميل ملايين الكتب المقرصنة . رسم القاضي ألسوب خطًا واضحًا: الكتب المشتراة قانونيًا والممسوحة ضوئيًا للتدريب الداخلي = استخدام عادل؛ النسخ الرقمية المقرصنة = مسؤولية . غطت التسوية أكثر من 91% من المؤلفين المؤهلين، وفقًا لأنثروبيك .
ISBNdb، وهي شركة تدعي تشغيل أكبر قاعدة بيانات كتب في العالم (أكثر من 111 مليون عنوان مفهرس)، أصبحت الآن وسيطًا في عمليات شراء الكتب المطبوعة بكميات كبيرة لشركات الذكاء الاصطناعي . عرض ISBNdb على مختبرات الذكاء الاصطناعي واضح: "أفضل بيانات تدريب للذكاء الاصطناعي في العالم موجودة على الرف" — وخدمتها ترتب طلبيات تتراوح بين 1000 ومليون كتاب لكل تعاقد، تحت اتفاقيات عدم إفشاء صارمة .
الشركة تسوق صراحة الكتب المنشورة قبل 2022 على أنها مثالية لأنها خالية من النصوص المولدة بالذكاء الاصطناعي . الكتب، كما تقول، هي "كثيفة، محررة، موثوقة" . ISBNdb تعترف بأن "مشكلة الصور العامة حقيقية" — المشترون عادة ما يرفضون الكشف عن المختبر الذي يمثلونه، وسلسلة التوريد مصممة لإخفاء العميل النهائي . تم إطلاق عريضة على Change.org تطالب ISBNdb بوقف التوسط في بيع العناوين النادرة والنفاد طبعها للتدمير .
تجار الكتب الهولنديون القدماء يبلغون أن شركات الذكاء الاصطناعي تشتري وتدمر كتبًا نادرة من قبل القرن التاسع عشر — بما في ذلك موسوعات قانونية هولندية من القرن الثامن عشر ومخطوطات لاهوتية لاتينية من القرن السابع عشر — بأسعار تتراوح بين 3 و5 أضعاف سعر السوق . التجار يخشون أن النسخ الفريدة الباقية من الأعمال العلمية والإقليمية الغامضة تُفقد إلى الأبد. على عكس الكتب الورقية ذات الإنتاج الضخم، توجد العديد من هذه العناوين في بضع نسخ فقط على مستوى العالم .
العملية صناعية: الكتب تصل على منصات نقالة، تُغذى في ماسحات قطع الفصوص التي يمكنها معالجة آلاف المجلدات يوميًا، والبقايا المادية تُرسل إلى مصانع اللب — دون أن تحصل أي مكتبة أو أرشيف على نسخة . لأن المسح التدميري يحدث في الخفاء والنسخ الأصلية تُدمر، لا يوجد سجل عام لما فُقد، مما يجعل من المستحيل تقييم الخسارة الثقافية الكاملة . التجار وأمناء المحفوظات يرون أن غياب الشفافية هذا يعني أن الضرر غير مرئي وغير قابل للاسترداد .