لا يعرف أنه لا يعرف
النموذج اللغوي لا يكذب ولا يعرف أنه يخطئ: إنه ينتج دائمًا الكلمة الأكثر احتمالًا، صحّت هذه الكلمة أو لم تصحّ.
النموذج اللغوي قد يؤكّد واقعة خاطئة بالثقة نفسها تمامًا التي يؤكّد بها واقعة صحيحة. وهذا ليس كذبًا، وليس أيضًا خطأً كان في مقدور النموذج أن يجنّبه لو كان أكثر انتباهًا. والسبب يعود إلى طريقة صناعة النصّ، وإلى طريقة تقييم هذه النماذج أثناء تدريبها.
ما يفعله النموذج، بالضبط
النموذج اللغوي لا يراجع قاعدة وقائع ليجيب. إنه ينتج، رمزًا بعد رمز، الكلمة الأكثر احتمالًا بحسب كل ما يسبق. وهذا الإنتاج يمضي بالطريقة نفسها، كانت الجملة الجاري كتابتها صحيحة أو لا: فلا شيء، في الحساب، يتوقّف للتحقّق من واقعة في مقابل العالم الحقيقي. والجواب الخاطئ يُكتَب بالسلاسة نفسها التي يُكتَب بها الجواب الصحيح، لأنه يمرّ بالآلية نفسها.
اختبار يعطي فيه التخمين أكثر من الامتناع
ويبقى سؤال: لماذا لا يصحّح التدريب هذا الميل إلى الثقة؟ دراسة لـ Adam Tauman Kalai وOfir Nachum وSantosh S. Vempala وEdwin Zhang، نُشرت في 2025، تجيب بمقارنة دقيقة. فالإجراءات التي تقيّم نموذجًا أثناء تدريبه تعمل غالبًا كاختبار متعدّد الخيارات مُقيَّم بالطريقة القديمة: فالجواب الصحيح يكسب نقطة، والخانة المتروكة بيضاء لا تكسب شيئًا، والجواب الخاطئ لا يكلّف شيئًا أيضًا. وفي هذا السلّم، يبقى التخمين دائمًا أفضل استراتيجية، حتى بلا معرفة. والنموذج المدرَّب ثم المُقيَّم بقواعد مشابهة يتعلّم الدرس نفسه: فالإجابة، بدل الإقرار بعدم اليقين، تكسب أرضًا في الدرجات التي تُحتسَب.
مثل تلاميذ أمام سؤال صعب، تخمّن النماذج أحيانًا بدل أن تقرّ بعدم يقينها.
وأصحاب الدراسة لا يكتفون بالتشخيص. فهم يقدّمون جوابًا سهل القول بقدر ما هو صعب التعميم: تغيير سلّم التقييمات حتى يكلّف الإقرار بعدم اليقين أقلّ من جواب خاطئ. وما لم يصر هذا هو القاعدة في الشبكات التي تصنّف النماذج، يبقى التخمين الاستراتيجية الأكثر عائدًا في التدريب.
لماذا لا يُرى ذلك من الداخل
ولا شيء، في النصّ المُنتَج، يحمل أثر عدم اليقين هذا. فالنموذج ليست لديه وحدة منفصلة تقيّم موثوقيته هو قبل كتابة جملة: ولا حدّ داخلي يفصل «أعرف» من «أخمّن». وهذا الغياب، الموثَّق في تخليص Lei Huang ومشاركيه لمجموع أسباب الهلوسة وأشكالها في النماذج اللغوية الكبيرة، يشرح لماذا يصعب رصد الخطأ من الخارج إلى هذا الحدّ: فهو لا يُعلِن عن نفسه بأي علامة في النبرة أو الطول أو بنية الجملة.
خلاف غير محسوم: هل الهلوسة حتمية؟
ونقطة تمضي أبعد، وهي تبقى موضع نقاش. في 2024، نشر Ziwei Xu وSanjay Jain وMohan Kankanhalli برهانًا صوريًا، مبنيًّا على نظرية القابلية للحساب: فالنموذج اللغوي، كونه دالة قابلة للحساب، لا يستطيع تعلّم كل الدوال القابلة للحساب الممكنة، وسينتج إذن دائمًا، على مجموعة لا نهائية من الأسئلة الممكنة، جوابًا خاطئًا واحدًا على الأقلّ. ويعرض أصحابه هذه النتيجة كحدّ بنيوي يصحّ على كل نموذج من هذا النوع. وهو عمل نظري، لا ملاحظة استخدام: فأصحابه أنفسهم يلاحظون أن هذا العالم الصوري يبقى أبسط من العالم الحقيقي.
وفي 2025، ردّ Atsushi Suzuki وYulan He وFeng Tian وZhongyuan Wang دون أن ينقضوا البرهان: فهم يقبلونه، لكنهم يعترضون على مداه. ففي رأيهم، حتى إن لم يكن ممكنًا أن تزول الهلوسة كليًا على مجموعة لا نهائية من الحالات، فإن احتمالها يمكن أن يقلّ دائمًا، حتى يصير مهملًا، بتحسين بيانات التدريب والطرق. ونتيجةُ استحالة نظرية، مُستخرَجة بحجّة على عالم من الدوال القابلة للحساب، لا تقول إذن شيئًا عن المشكلات التي تُلاقى فعلًا في الاستخدام. والخلاف يتعلّق بالرياضيات أقلّ، ولا أحد يعترض عليها، ممّا يتعلّق بما تسمح باستخلاصه بشأن نموذج مستخدَم فعلًا.
أطروحة الحتمية
النموذج اللغوي دالة قابلة للحساب. ولا يستطيع تعلّم كل الدوال القابلة للحساب الممكنة. فهو سيهلوس إذن دائمًا، في سؤال واحد على الأقلّ، أيًّا كانت جودة تدريبه (Xu وJain وKankanhalli، 2024).
ردّ 2025
البرهان قائم، لكن على مجموعة لا نهائية من الحالات فقط. وعمليًا، يقلّ احتمال الهلوسة ببيانات أفضل، حتى يصير مهملًا (Suzuki وHe وTian وWang، 2025).
وما يتشاركه النصّان، على خلافهما، يلتقي بالملاحظة الأولى: فلا النظرية ولا الممارسة تتيح لنموذج أن يميّز، في لحظة كتابته، جوابًا غير مؤكَّد من جواب خاطئ يُقال بالثقة نفسها. وفصل الدورة المخصَّص لـلماذا يختلق النموذج يفصّل الآلية خلف هذه الملاحظة.
المصادر
- Why Language Models Hallucinate Adam Tauman Kalai، Ofir Nachum، Santosh S. Vempala، Edwin Zhang، 2025.
- A Survey on Hallucination in Large Language Models Lei Huang وآخرون، 2023.
- Hallucination is Inevitable: An Innate Limitation of Large Language Models Ziwei Xu، Sanjay Jain، Mohan Kankanhalli، 2024. عمل نظري مداه العملي موضع اعتراض: انظر المصدر التالي.
- Hallucinations are inevitable but can be made statistically negligible Atsushi Suzuki، Yulan He، Feng Tian، Zhongyuan Wang، 2025.
هذا المقال منشور برخصة CC BY 4.0: انسخه، وترجمه، وأعد نشره مع ذكر ODERSA.