هذا موقع رسمي تابع لـ ODERSA. إليكم كيف تتأكّدون

النطاق الرسمي

عنوان هذا الموقع ينتهي بـ odersa.org. كل خدمة من خدمات الجمعية توجد على نطاق فرعي من odersa.org، ولا في أي مكان آخر. وإذا كان العنوان الظاهر في شريط متصفّحكم لا ينتهي بـ odersa.org، فهذا الموقع ليس موقعنا.

مجاني، وبلا حساب

كل شيء متاح من اللحظة الأولى: لا تسجيل، ولا حساب، ولا كلمة مرور، ولا اشتراك، ولا إعلانات. ولا شيء محجوز لمن يدفع، لأن لا شيء هنا يُدفع.

لا جمع لأي بيانات

هذا الموقع لا يتعقّبكم: لا أدوات تتبّع، ولا ملفات تعريف ارتباط للتتبّع، ولا أي أداة قياس مدمجة في هذه الصفحات، ولا شيء يُقاس على جهازكم. مُضيفنا يَعُدّ الطلبات بشكل إجمالي، كما يفعل أي خادم يستجيب: مجموع، لا ملف شخصي. ولا حاجة أن تصدّقونا: افتحوا أدوات المطوّر في متصفّحكم، تبويب الشبكة، وأعيدوا تحميل الصفحة. سترون القائمة الكاملة لما يطلبه الموقع. كل شيء يأتي من odersa.org، ولا شيء يذهب إلى مكان آخر.

محتوى حر

المحتوى منشور برخصة CC BY 4.0. يمكنكم نسخه وترجمته وطبعه وإعادة توزيعه، في دروسكم كما بين من حولكم، بشرط واحد: ذكر ODERSA.

لا يعرف أنه لا يعرف

النموذج اللغوي لا يكذب ولا يعرف أنه يخطئ: إنه ينتج دائمًا الكلمة الأكثر احتمالًا، صحّت هذه الكلمة أو لم تصحّ.

النموذج اللغوي قد يؤكّد واقعة خاطئة بالثقة نفسها تمامًا التي يؤكّد بها واقعة صحيحة. وهذا ليس كذبًا، وليس أيضًا خطأً كان في مقدور النموذج أن يجنّبه لو كان أكثر انتباهًا. والسبب يعود إلى طريقة صناعة النصّ، وإلى طريقة تقييم هذه النماذج أثناء تدريبها.

ما يفعله النموذج، بالضبط

النموذج اللغوي لا يراجع قاعدة وقائع ليجيب. إنه ينتج، رمزًا بعد رمز، الكلمة الأكثر احتمالًا بحسب كل ما يسبق. وهذا الإنتاج يمضي بالطريقة نفسها، كانت الجملة الجاري كتابتها صحيحة أو لا: فلا شيء، في الحساب، يتوقّف للتحقّق من واقعة في مقابل العالم الحقيقي. والجواب الخاطئ يُكتَب بالسلاسة نفسها التي يُكتَب بها الجواب الصحيح، لأنه يمرّ بالآلية نفسها.

اختبار يعطي فيه التخمين أكثر من الامتناع

ويبقى سؤال: لماذا لا يصحّح التدريب هذا الميل إلى الثقة؟ دراسة لـ Adam Tauman Kalai وOfir Nachum وSantosh S. Vempala وEdwin Zhang، نُشرت في 2025، تجيب بمقارنة دقيقة. فالإجراءات التي تقيّم نموذجًا أثناء تدريبه تعمل غالبًا كاختبار متعدّد الخيارات مُقيَّم بالطريقة القديمة: فالجواب الصحيح يكسب نقطة، والخانة المتروكة بيضاء لا تكسب شيئًا، والجواب الخاطئ لا يكلّف شيئًا أيضًا. وفي هذا السلّم، يبقى التخمين دائمًا أفضل استراتيجية، حتى بلا معرفة. والنموذج المدرَّب ثم المُقيَّم بقواعد مشابهة يتعلّم الدرس نفسه: فالإجابة، بدل الإقرار بعدم اليقين، تكسب أرضًا في الدرجات التي تُحتسَب.

مثل تلاميذ أمام سؤال صعب، تخمّن النماذج أحيانًا بدل أن تقرّ بعدم يقينها.

وأصحاب الدراسة لا يكتفون بالتشخيص. فهم يقدّمون جوابًا سهل القول بقدر ما هو صعب التعميم: تغيير سلّم التقييمات حتى يكلّف الإقرار بعدم اليقين أقلّ من جواب خاطئ. وما لم يصر هذا هو القاعدة في الشبكات التي تصنّف النماذج، يبقى التخمين الاستراتيجية الأكثر عائدًا في التدريب.

لماذا لا يُرى ذلك من الداخل

ولا شيء، في النصّ المُنتَج، يحمل أثر عدم اليقين هذا. فالنموذج ليست لديه وحدة منفصلة تقيّم موثوقيته هو قبل كتابة جملة: ولا حدّ داخلي يفصل «أعرف» من «أخمّن». وهذا الغياب، الموثَّق في تخليص Lei Huang ومشاركيه لمجموع أسباب الهلوسة وأشكالها في النماذج اللغوية الكبيرة، يشرح لماذا يصعب رصد الخطأ من الخارج إلى هذا الحدّ: فهو لا يُعلِن عن نفسه بأي علامة في النبرة أو الطول أو بنية الجملة.

خلاف غير محسوم: هل الهلوسة حتمية؟

ونقطة تمضي أبعد، وهي تبقى موضع نقاش. في 2024، نشر Ziwei Xu وSanjay Jain وMohan Kankanhalli برهانًا صوريًا، مبنيًّا على نظرية القابلية للحساب: فالنموذج اللغوي، كونه دالة قابلة للحساب، لا يستطيع تعلّم كل الدوال القابلة للحساب الممكنة، وسينتج إذن دائمًا، على مجموعة لا نهائية من الأسئلة الممكنة، جوابًا خاطئًا واحدًا على الأقلّ. ويعرض أصحابه هذه النتيجة كحدّ بنيوي يصحّ على كل نموذج من هذا النوع. وهو عمل نظري، لا ملاحظة استخدام: فأصحابه أنفسهم يلاحظون أن هذا العالم الصوري يبقى أبسط من العالم الحقيقي.

وفي 2025، ردّ Atsushi Suzuki وYulan He وFeng Tian وZhongyuan Wang دون أن ينقضوا البرهان: فهم يقبلونه، لكنهم يعترضون على مداه. ففي رأيهم، حتى إن لم يكن ممكنًا أن تزول الهلوسة كليًا على مجموعة لا نهائية من الحالات، فإن احتمالها يمكن أن يقلّ دائمًا، حتى يصير مهملًا، بتحسين بيانات التدريب والطرق. ونتيجةُ استحالة نظرية، مُستخرَجة بحجّة على عالم من الدوال القابلة للحساب، لا تقول إذن شيئًا عن المشكلات التي تُلاقى فعلًا في الاستخدام. والخلاف يتعلّق بالرياضيات أقلّ، ولا أحد يعترض عليها، ممّا يتعلّق بما تسمح باستخلاصه بشأن نموذج مستخدَم فعلًا.

أطروحة الحتمية

النموذج اللغوي دالة قابلة للحساب. ولا يستطيع تعلّم كل الدوال القابلة للحساب الممكنة. فهو سيهلوس إذن دائمًا، في سؤال واحد على الأقلّ، أيًّا كانت جودة تدريبه (Xu وJain وKankanhalli، 2024).

ردّ 2025

البرهان قائم، لكن على مجموعة لا نهائية من الحالات فقط. وعمليًا، يقلّ احتمال الهلوسة ببيانات أفضل، حتى يصير مهملًا (Suzuki وHe وTian وWang، 2025).

وما يتشاركه النصّان، على خلافهما، يلتقي بالملاحظة الأولى: فلا النظرية ولا الممارسة تتيح لنموذج أن يميّز، في لحظة كتابته، جوابًا غير مؤكَّد من جواب خاطئ يُقال بالثقة نفسها. وفصل الدورة المخصَّص لـلماذا يختلق النموذج يفصّل الآلية خلف هذه الملاحظة.

المصادر

هذا المقال منشور برخصة CC BY 4.0: انسخه، وترجمه، وأعد نشره مع ذكر ODERSA.

العودة إلى المدوّنة