أجرى فريق صحفي اختباراً كاملاً على النسخة الإلكترونية من رواية C’était ça ou mourir للكاتب الكندي-الهاييتي ثيليسون أورليان باستخدام أداة كشف النصوص المولّدة بالذكاء الاصطناعي Pangram. أظهرت الأداة أن 94% من نص الرواية اعتُبر محتوى مولّدًا بالذكاء الاصطناعي، بينما حصلت روايات مرشحة أخرى في الجائزة الأدبية نفسها المتاحة بنسخ رقمية على تصنيف «100% بشري» من Pangram.
النتيجة أثارت جدلاً واسعاً على منصات التواصل وفي وسائل إعلام كندية وأوروبية، خصوصاً مع طروحات متباينة حول موثوقية أدوات الكشف عن المحتوى الآلي وقدرة هذه الأدوات على التمييز بين الأساليب الأدبية البشرية وأنماط توليد النصوص الآلية.
مصداقية Pangram وكيف تم تدريبه
تفيد نتائج اختبارات بحثية سابقة أن Pangram يختلف عن كثير من أنظمة الكشف الأخرى. بحسب البروفسورة مارزينا كاربينسكا من جامعة سايمون فريزر، فإن مطوّري Pangram درّبوا الأداة على ملايين نصوص مكتوبة بيد بشر، ثم طلبوا من نماذج ذكاء اصطناعي إعادة صياغة تلك النصوص، فدرّبوا النظام على التمييز بين النصوص البشرية ونُسخها المعدلة آلياً. هذا الأسلوب، وفق توصيف الباحثة، يمكّن Pangram من رسم فروق إحصائية ثابتة بين أسلوب الإنسان وميل نماذج الذكاء الاصطناعي إلى تكرار أنماط محددة.
في اختبارات سابقة أُجريت عام 2024، سجّل فريق كاربينسكا معدل إنذارات كاذبة (false positives) بنحو 2% لنسخ نصوص مختلفة. لكنها تقول إن الأداة تحسّنت منذ ذلك الحين، وتقدّر أن معدل الإنذارات الكاذبة على نصوص فرنسية الآن يبلغ حوالي 0.0026%، وعلى نصوص أدبية إنجليزية يكاد يصل إلى 0%.
نتائج على النصوص الأدبية وطول النص
توضح الباحثة أن Pangram يصبح أكثر موثوقية مع زيادة طول النص، لأن تباين الأسلوب البشري عبر صفحات أطول يصعّب على نماذج الذكاء الاصطناعي المحافظة على نمط ثابت. بحسبها، فإن النصوص الأدبية تميل إلى تفاوت أكبر في الشكل والأسلوب مقارنة بمقالات الأخبار أو الوصفات، ما يجعل عناصر التمييز بين النص البشري والنص الآلي أكثر وضوحًا.
في حالة رواية أورليان، اشتُرِيَت النسخة الإلكترونية وأُرسِلَت كاملة إلى Pangram الذي أعاد النتيجة: 94% من النص مُعتبر مولّدًا بالذكاء الاصطناعي، مع إدراك الأداة بأن العمل لم يأتِ «مولّدًا بالكامل» لأن سيناريو إنتاج مئات الصفحات عبر موجه واحد غير مرجّح، مما يشي بوجود تدخل بشري لتعديل أو ترتيب المحتوى.
اختبار كامل للرواية عبر أداة Pangram أظهر أن 94% من نص ‘C’était ça ou mourir’ تم تصنيفه كمحتوى مولّد بالذكاء الاصطناعي، بينما روايات مرشحين آخرين لجائزة غونكور ظهرت بنتيجة 100% بشرية.اعتراضات الكاتب والرد العلمي
قدّم الكاتب ثيليسون أورليان وبعض مَن تعاطفوا معه تفسيرات متعدّدة لنتيجة Pangram، من بينها فرضية أن «الأسلوب الكاريبي» للكاتب قد يؤثّر على تصنيف الأداة. الباحثة كاربينسكا تعتبر هذا الطرح «صعب التصديق» لأن الأداة أعطت نتائج مماثلة حتى مع ترجمات للنص إلى الإنجليزية، وفق اختباراتها، فيما نصوص بشرية مترجمة مماثلة لم تُصنَّف على أنها آلية.
يؤكد خبراء آخرون في تحليل البيانات أنهم توصّلوا إلى استنتاجات مشابهة حول ندرة الإنذارات الكاذبة عندما تُقيّم الأدوات بالنحو الذي اعتمده Pangram، لكنه يبقى أن لا أحد يمكنه إعلان يقين بنسبة 100% بشأن مصدر كل سطر من نص طويل.
شبهات تضارب مصالح وتوضيحات الباحثة
بعد تداول النتائج، لفتت مراجعات إلى أن كاربينسكا شاركت في ورقة بحثية ظهرت فيها أسماء موظفين من Pangram كمتعاونين. توضّح الباحثة أن الشركة قدّمت موارد تقنية (مثل «رموز تشغيل» لتمكين إجراء التحليل) وساعدت في تفسير بعض الجوانب التقنية، لكنها نفت وجود علاقة مالية أو ارتباط مهني مستمر، وأكدت أن فريقها يسعى دائماً لاختبار حدود الأداة وكشفها عند الإمكان.
الجدل مستمر: النتائج أثارت تساؤلات حول الدور المستقبلي للذكاء الاصطناعي في الأدب وكيفية اعتماد ناشرين ولجان جوائز على أدوات كشف المحتوى الآلي. وفي الوقت نفسه، يذهب بعض الخبراء إلى أن Pangram يُعد من بين الأدوات الأكثر حاجة للثقة إذا أُخِذَت عينات نصية طويلة وأساليب تدريبية دقيقة في الحسبان.
ما التالي؟
يبقى ملف رواية ثيليسون أورليان مفتوحاً للتحقيق والنقاش الأخلاقي والأدبي. أي استنتاج نهائي حول درجة «الاعتماد على الذكاء الاصطناعي» في عمل أدبي طويل يتطلب مزيداً من الشفافية عن منهجيات التدريب، وإمكانية الوصول إلى مقابلات تقنية متبادلة بين مطوّري الأدوات والباحثين المستقلين، إضافة إلى اختبارات إضافية على نصوص أدبية متنوعة.