العالم - تكنولوجيا
شركات الذكاء الاصطناعي تشتري الكتب المستعملة.. ما القصة؟
من رفوف الكتب المستعملة إلى مراكز البيانات.. لماذا تحوّل شركات الذكاء الاصطناعي الكتب الورقية إلى مصدر جديد للبيانات؟
ا
العين السورية
نشر في: ٢٤ سبتمبر ٢٠٢٦، ١١:٢٠
الوقت المتوقع للقراءة: 3 دقيقة

لم يعد السباق على تطوير الذكاء الاصطناعي يجري فقط داخل مراكز البيانات العملاقة، ولا عبر جمع مليارات الصفحات من الإنترنت. في مشهد يكشف حجم الطلب على المعلومات، بدأت الكتب الورقية المستعملة تدخل هي الأخرى في دائرة اهتمام شركات الذكاء الاصطناعي، بعدما تحولت إلى مصدر محتمل للبيانات التي تحتاجها النماذج اللغوية لتتعلم وتتحسن.
وخلال الأشهر الأخيرة، تحدث باعة كتب مستعملة في بريطانيا وأيرلندا وأستراليا عن طلبات شراء جماعية وغير معتادة، تشمل أحياناً آلاف الكتب بعناوين وموضوعات متباعدة، ما أثار شكوكاً حول استخدام هذه الكتب في عمليات جمع البيانات المرتبطة بالذكاء الاصطناعي.
ووفق صحيفة الغارديان، لاحظ بعض الباعة أن الطلبات كانت تبدو وكأنها ناتجة عن خوارزميات تختار الكتب بكميات كبيرة، مع شحنها إلى جهات أو مستودعات محددة.
عندما يتحول الكتاب إلى ملف بيانات
القصة ليست مجرد شراء كتب للقراءة، فوثائق قضائية كُشف عنها في الولايات المتحدة أظهرت أن شركة Anthropic، المطورة لنموذج Claude، أنفقت ملايين الدولارات لشراء ملايين الكتب المطبوعة، كثير منها مستعمل.
بعد شراء الكتب، كانت عمليات المعالجة أكثر إثارة للجدل حيث تُزال أغلفة الكتب وتُفصل الصفحات، ثم تُمسح ضوئياً وتحول إلى ملفات رقمية قابلة للقراءة بواسطة الحاسوب. وفي بعض الحالات، كان مصير النسخ الورقية بعد المسح هو إعادة التدوير. وتظهر وثائق المحكمة أن الشركة بنت من هذه العملية مكتبة رقمية ضخمة لاستخدامها في البحث وتطوير نماذج الذكاء الاصطناعي.
وهكذا يصبح الكتاب بالنسبة إلى مختبر الذكاء الاصطناعي شيئاً مختلفاً عن قيمته التقليدية. فهو ليس بالضرورة كتاباً يراد الاحتفاظ به، بل وعاء لملايين الكلمات والجمل والأفكار التي يمكن تحويلها إلى بيانات تدريب.
لماذا تحتاج الشركات إلى الكتب؟
الإنترنت وفر للذكاء الاصطناعي كميات هائلة من المعلومات، لكن المشكلة أن جزءاً كبيراً من المحتوى الرقمي أصبح مستهلكاً بالفعل في عمليات التدريب السابقة، كما أن حقوق استخدام كثير من المواد المنشورة على الإنترنت أصبحت موضع نزاع قانوني.
أما الكتب فتقدم محتوى طويلاً ومنظماً، وتضم أعمالاً أدبية وأبحاثاً ودراسات وكتباً تعليمية ومعلومات متخصصة لا تكون متاحة دائماً بصورة رقمية مفتوحة.
لهذا يمكن أن تكون المكتبات الورقية القديمة، بما فيها الكتب المستعملة، مصدراً مهماً لتوسيع قاعدة البيانات التي تتعلم منها النماذج.
لكن الطريق إلى هذه البيانات فتح معركة أخرى: من يملك الحق في استخدام ما كتبه البشر لتدريب الآلات؟
من الكتاب إلى المحكمة
قضية Anthropic أصبحت واحدة من أبرز الأمثلة على هذا الصراع. ففي تموز 2026 وافق قاضٍ أميركي على تسوية بقيمة 1.5 مليار دولار مع مؤلفين اتهموا الشركة باستخدام نسخ مقرصنة من كتبهم في تدريب Claude
وكانت القضية قد شهدت حكماً مهماً في 2025 اعتبر أن تدريب الذكاء الاصطناعي على الكتب المحمية بحقوق النشر يمكن أن يندرج في ظروف معينة ضمن الاستخدام العادل، لكنه فرّق بين ذلك وبين طريقة الحصول على بعض الكتب، بعدما خلص إلى أن الشركة حصلت بصورة غير قانونية على ملايين النسخ من مصادر مقرصنة.
وهذا التفريق مهم، لأن شراء كتاب ورقي بصورة قانونية لا يعني تلقائياً أن كل استخدام رقمي لمحتواه أصبح مباحاً.
سوق الكتب المستعملة أمام سؤال جديد
اللافت أن تدفق الطلبات على الكتب المستعملة بدأ يثير أسئلة خارج أروقة المحاكم أيضاً.
فباعة الكتب الذين اعتادوا التعامل مع القراء وجامعي الكتب يواجهون الآن احتمال دخول طرف جديد إلى السوق: شركات أو وسطاء يبحثون عن الكتب باعتبارها مادة خام للبيانات.
وفي أستراليا، أثارت طلبات شراء واسعة مخاوف لدى بعض تجار الكتب النادرة من احتمال وصول كتب تاريخية أو نادرة إلى عمليات المسح والتخلص منها، بينما نفت بعض الجهات الوسيطة ارتباطها بمثل هذه العمليات.
المفارقة هنا أن التكنولوجيا التي يفترض أنها تنقل المعرفة إلى المستقبل قد تعود إلى الماضي بحثاً عنها؛ إلى رفوف المكتبات، وصناديق الكتب المستعملة، والكتب التي لم تجد طريقها إلى العالم الرقمي.
وبينما تتسابق شركات الذكاء الاصطناعي للحصول على مزيد من البيانات، يتسع السؤال الذي سيحدد المرحلة المقبلة: هل يمكن تدريب الآلات على المعرفة البشرية من دون إعادة رسم قواعد الملكية الفكرية التي تحكم هذه المعرفة؟
الإجابة لم تُحسم بعد، لكن المؤكد أن الكتاب لم يعد مجرد منتج ثقافي في اقتصاد الذكاء الاصطناعي؛ بل أصبح، في بعض الحالات، أصلاً من أصول البيانات.


