ثلاث استراتيجيات تجعل إجابة النموذج موثوقة: الاتّساق الذاتي وRAG وReAct

كيف تثبّت إجابة النموذج وتصحّحها وتوثّقها؟ الاتّساق الذاتي يصوّت على أفضل استدلال، وRAG يلزمه بمصادرك، وReAct يمنحه أدوات يتحقّق بها. مع مصفوفة قرار عملية وتطبيق الثلاثة على منصّة Dify.

فريق INTXA 11 دقيقة قراءة حُدِّث في 23 سبتمبر 2026

تعلّمنا في مقال الدور وسلسلة التفكير كيف نضبط مَن يتكلّم وكيف يفكّر. هنا نعالج المشكلة الأصعب: كيف نجعل إجابة النموذج موثوقة؟

كل استراتيجية من الثلاث تعالج نوعًا مختلفًا من الفشل:

تذبذب الاستدلال

الاتّساق الذاتي

النموذج يعرف الطريق، لكنه يخطئ فيه أحيانًا. الحلّ: عدّة مسارات تفكير ثم تصويت.

الجهل والهلوسة

RAG

النموذج لا يعرف مصادرك، أو معرفته قديمة. الحلّ: استرجاع المصادر ثم التوليد منها.

العجز عن التحقّق

ReAct

المهمّة متعدّدة الخطوات ولا تُعرف مسبقًا. الحلّ: حلقة فكّر، ثم نفّذ، ثم لاحظ.

70 دقيقةمدة القراءة والتطبيق
3استراتيجيات متكاملة
3تطبيقات على Dify

الاستراتيجية الأولى: الاتّساق الذاتي (Self-Consistency)#

جعلنا النموذج يفكّر خطوة بخطوة، لكن ماذا لو كانت خطواته نفسها خاطئة هذه المرة؟ التوليد احتمالي: قد يسلك مسارًا سليمًا مرة ومسارًا معطوبًا مرة أخرى.

الفكرة البسيطة العبقرية: لا تسأله مرة واحدة. اسأله عدّة مرات بمسارات مستقلّة، ثم خذ الإجابة الأكثر تكرارًا. الاستدلال الصحيح يميل إلى التقارب، أمّا الأخطاء فتتشتّت في اتجاهات مختلفة.

مثال: تسعير مشروع ترجمة#

عقد ترجمة من 40 ألف كلمة بسعر 0.08 دولار للكلمة. طلب العميل خصمًا بنسبة 10٪، ويتحمّل المكتب رسوم تحويل بنسبة 3٪ من صافي المبلغ بعد الخصم. كم يستلم المكتب فعليًّا؟

ثلاثة مسارات تتّفق

  1. القيمة: 40,000 × 0.08 = 3,200 دولار.
  2. بعد الخصم: 3,200 × 0.90 = 2,880 دولارًا.
  3. بعد رسوم التحويل: 2,880 × 0.97 = 2,793.60 دولارًا.

مساران يخطئان بطريقتين مختلفتين

  • مسار طرح النسبتين معًا من الأصل: 3,200 × 0.87 = 2,784 دولارًا.
  • مسار نسي رسوم التحويل: 2,880 دولارًا.

خطآهما مختلفان، فلا تتكوّن منهما أغلبية؛ وهذا بالضبط سبب نجاح التصويت.

لماذا يعمل؟ الحدس الإحصائي

للمسألة إجابة صحيحة واحدة، لكن طرق الخطأ لا نهائية. حين تولّد عدّة مسارات، تتّفق المسارات السليمة على الرقم نفسه بينما تتفرّق المعطوبة كلٌّ في اتجاه. الأغلبية إذن ليست «ديمقراطية»، بل كاشف تقارب. وقد أظهرت ورقة Wang وزملائه (2022) أن هذا يرفع الدقّة بفروق ملموسة على مقاييس الاستدلال الحسابي مقارنةً بمسار واحد.

الاستراتيجية الثانية: التوليد المعزّز بالاسترجاع (RAG)#

التصويت يُصلح الاستدلال، لكنه لا يُصلح الجهل. لو لم يكن النموذج يعرف المصطلح المعتمد في مؤسستك، فخمسة مسارات ستتّفق على الخطأ نفسه. الحلّ ليس أن «يتذكّر» أكثر، بل ألّا يعتمد على ذاكرته أصلًا: نُحضر له المصادر الصحيحة لحظة السؤال، ونلزمه بالإجابة منها وحدها. هذا هو RAG: استرجاع ثم توليد.

  1. السؤال

    «ما المقابل المعتمد لدينا لمصطلح indemnity؟ وما القاعدة المتّبعة؟»

  2. تحويله إلى متّجه

    يُمثَّل السؤال رقميًّا في فضاء المعنى، كما مُثّلت كل مقاطع المستندات من قبل.

  3. البحث في الفهرس

    تُقاس المسافة بين متّجه السؤال ومتّجهات المقاطع، وتُسترجع الأقرب معنًى لا الأكثر تطابقًا في الكلمات.

  4. حقن المقاطع

    تُوضع المقاطع المسترجعة في سياق الأمر مع تعليمات صريحة بالالتزام بها.

  5. توليد بالمصادر

    يجيب النموذج من المقاطع وحدها، ويذكر مصدر كل معلومة.

لنفترض أن قاعدة المعرفة تحوي خمسة مقاطع: مسرد المؤسسة المعتمد، ودليل الأسلوب، ومحضر اجتماع تسويق، وملاحظات المراجع اللغوي، وسياسة الإجازات. محرّك الاسترجاع الجيد يتجاهل مقطعَي التسويق والإجازات تمامًا، لأن الاسترجاع يقوم على القرب الدلالي لا على مطابقة الكلمات.

دون RAG: من ذاكرة النموذج

«indemnity تعني الضمان أو التعويض.» إجابة عامة تخلط بين مفهومين، ولا تستند إلى أي قاعدة معتمدة لديك.

مع RAG: من مصادرك

«المقابل المعتمد: التعويض، ويُفضَّل «شرط التعويض» إذا ورد عنوانًا لبند [المسرد، الإصدار 4]. لا يُترجم «ضمانًا» تجنّبًا للالتباس مع warranty؛ فالأول يعوّض ضررًا وقع، والثاني يضمن صفة أو أداءً [ملاحظات المراجع]. وعند وروده أول مرة يُذكر الأصل الإنجليزي بين قوسين [دليل الأسلوب، القسم 3.2].»

الاستراتيجية الثالثة: التفكير والتصرّف معًا (ReAct)#

RAG يجلب المصادر مرة واحدة قبل الإجابة. لكن ماذا لو لم يكن النموذج يعرف مسبقًا ما الذي يحتاج إلى البحث عنه؟ ماذا لو احتاج أن يبحث، فيقرأ، فيكتشف أنه يحتاج بحثًا آخر؟

هنا يأتي ReAct (Reasoning + Acting): يتناوب النموذج بين فكرة يخطّط بها، وفعل ينفّذه بأداة، وملاحظة يقرأ بها النتيجة، ثم يقرّر خطوته التالية. وهذا بالضبط تعريف الوكيل (Agent).

تتبّع الحلقة: مراجعة بند في عقد#

المهمّة: «راجع البند السابع في عقد العميل: هل مدّة الإخطار المذكورة تطابق سياستنا المعتمدة؟ وما المقابل الصحيح لمصطلحه؟»

  1. فكرة

    أحتاج أولًا إلى قراءة نص البند السابع، لا تخمينه.

  2. فعل: قارئ المستندات

    فتح العقد واستخراج البند السابع.

  3. ملاحظة

    البند ينصّ على إخطار مدّته 15 يومًا، ويستخدم مصطلح termination for convenience.

  4. فكرة

    أحتاج إلى سياسة المؤسسة لأعرف المدّة المعتمدة.

  5. فعل: البحث في قاعدة المعرفة

    استرجاع سياسة الإنهاء.

  6. ملاحظة

    السياسة تشترط إخطارًا لا يقل عن 30 يومًا.

  7. فعل: البحث في المسرد

    المقابل المعتمد: «الإنهاء للملاءمة».

  8. النتيجة

    البند مخالف للسياسة (15 يومًا مقابل 30)، مع المقابل المعتمد للمصطلح، ومسار كامل قابل للتدقيق.

الفرق الجوهري عن سلسلة التفكير: كل «ملاحظة» هنا تأتي من العالم الخارجي لا من داخل النموذج؛ فهو لا يخمّن مدّة الإخطار بل يقرؤها فعليًّا.

لماذا التناوب تحديدًا؟

لو فكّر فقط دون أدوات لظلّ حبيس معرفته القديمة وقد يهلوس. ولو نفّذ أفعالًا دون تفكير لتاه عند أول نتيجة غير متوقّعة. الجمع بينهما يعطي التآزر الذي وصفته ورقة Yao وزملائه: الأفكار تساعده على وضع الخطّة وتحديثها ومعالجة الاستثناءات، والأفعال تربطه بمصادر خارجية تصحّح مساره. والنتيجة أثر مقروء يمكنك تدقيقه خطوة خطوة.

متى تستخدم أيًّا منها؟ مصفوفة القرار#

القاعدة الأولى: شخِّص نوع الفشل أولًا، ثم اختر العلاج. الاستراتيجية الخاطئة تكلّفك مالًا وزمنًا بلا فائدة.

الاستراتيجيةتعالجاستخدمها حينلا تستخدمها حينالتكلفة
الاتّساق الذاتيتذبذب الاستدلالتوجد إجابة واحدة قابلة للتحقّق: حساب، أو تصنيف، أو استخلاص بندالمهام الإبداعية أو المفتوحةمن 3 إلى 5 أضعاف
RAGالجهل والهلوسةيجب أن تستند الإجابة إلى مستنداتك: مسرد، أو سياسة، أو عقدالمهمّة لا تحتاج معرفة خارجية، كإعادة صياغة نص أمامكاستدعاء واحد مع فهرسة
ReActالعجز عن التحقّقالمهمّة متعدّدة الخطوات وتحتاج إلى أدواتالمهمّة بسيطة أحادية الخطوةبعدد الدورات

الأقوى: أن تدمج الثلاث#

ليست بدائل متنافسة بل طبقات متكاملة. هكذا يبدو نظام مراجعة عقود احترافي:

  1. الطبقة الأولى: RAG

    ثبّت المعرفة: احقن المسرد المعتمد ودليل الأسلوب والسياسة في السياق، وألزم النموذج بذكر مصدر كل حكم.

  2. الطبقة الثانية: ReAct

    امنحه أدوات القراءة: البحث في العقد، وفتح السياسة، وحساب المدد. كل خطوة تُوثَّق في أثر قابل للتدقيق.

  3. الطبقة الثالثة: الاتّساق الذاتي

    على البنود الحرجة فقط (المبالغ والمدد والغرامات): كرّر الاستدلال ثلاث مرات، وإن اختلفت النتائج فارفعها إلى مراجعة بشرية.

هذه الاستراتيجيات لا تجعل النموذج «يفهم»، بل تجعل مخرجه قابلًا للتدقيق: التصويت يكشف عدم اليقين، وRAG يربط كل ادّعاء بمصدر، وReAct يترك أثرًا مقروءًا لكل خطوة. المسؤولية النهائية تبقى بشرية، لكن صارت لديك أدلّة لا انطباعات.

المعمل العملي: ابنِ الثلاث على Dify#

Playground وAI Studio ممتازتان لضبط الأمر الواحد، لكنهما لا تُظهران «خط الأنابيب». أمّا هنا فنحن في مستوى المعمارية: عُقد ومصادر وأدوات وحلقات. لذلك ننتقل إلى Dify، المنصّة مفتوحة المصدر لبناء تطبيقات النماذج بلوحة مرئية. المفاهيم نفسها تنتقل حرفيًّا إلى n8n أو LangGraph أو Flowise أو الكود الخام.

اختر التطبيق

  1. أنشئ قاعدة المعرفة

    من تبويب Knowledge ارفع المسرد ودليل الأسلوب (PDF أو Markdown أو TXT). تتولّى Dify التقطيع والتضمين والفهرسة.

  2. اضبط التقطيع بوعي

    مقطع أكبر يعني سياقًا أوفر ودقّة استرجاع أقل. للمسارد والبنود القصيرة اختر مقاطع صغيرة، وللمواد التفسيرية الطويلة اختر أكبر مع تداخل بسيط. هذا القرار وحده يحدّد نصف جودة نظامك.

  3. أضف عقدة Knowledge Retrieval

    في تطبيق Chatflow اسحب العقدة واربطها بقاعدتك، وابدأ بـ Top-K = 3 مع عتبة تشابه.

  4. ألزم النموذج بالمصادر

    في عقدة LLM اجعل السياق مخرج الاسترجاع، واكتب صراحةً: أجب من المقاطع فقط، واذكر المصدر، وقل «غير موجود» عند غياب الدليل.

  5. اختبر الاسترجاع لا الإجابة وحدها

    افحص أيّ المقاطع استُرجعت فعلًا. إن كانت خاطئة فالمشكلة في التقطيع أو الفهرسة، لا في صياغة الأمر.

تعليمات عقدة الحَكَم
قارن الإجابات الثلاث المرفقة.
- إن اتّفق اثنان فأكثر على رقم واحد فاعتمده، واذكر عدد المتّفقين.
- إن اختلفت جميعها فاكتب: «يتطلّب مراجعة بشرية»، واذكر الإجابات الثلاث.

واجهات Dify تتطوّر بسرعة؛ إن اختلف اسم زرّ عمّا هنا فابحث عن وظيفته لا عن اسمه، وراجع التوثيق الرسمي.

اختبر فهمك#

اختبر فهمك

قال زميل: «سأستخدم الاتّساق الذاتي كي يعرف النموذج مصطلحاتنا المعتمدة». ما التشخيص الصحيح؟

اختبر فهمك

كيف يعرف محرّك RAG أيّ المقاطع يسترجع؟

اختبر فهمك

ما الفرق الجوهري بين «الملاحظة» في ReAct و«الخطوة» في سلسلة التفكير؟

اختبر فهمك

عميل يشكو من أن مراجعة العقود «تخترع مواد قانونية أحيانًا، وتحسب الغرامات خطأً أحيانًا أخرى». ما الخطة الأدقّ؟