للمقارنة بين RAG والبحث العادي، افصل ما يعرضه النظام في آخر المسار. قد تحصل على قائمة مواد تفتحها بنفسك، أو على جواب يصوغه نموذج بعد تزويده بمادة مسترجعة. نستخدم هنا مسارين تعليميين محددين؛ لا نفترض أن كل محرك بحث يعرض روابط فقط، أو أن كل جواب مولد يتبع RAG.
الخلاصة السريعة
الاسترجاع يعثر على مادة، وفي مسار RAG تصل المادة إلى النموذج لصوغ جواب. راجع كلا من النص المختار والعبارة الناتجة؛ الوصول إلى نتيجة لا يثبت أنها تجيب السؤال.
- في RAG تضاف مادة مسترجعة إلى طلب النموذج قبل التوليد، كما تشرح AWS؛ البحث عن مادة والتوليد مرحلتان مختلفتان. [1]
- قائمة نتائج تترك لك قراءة المواد وربطها؛ الجواب المولد يحتاج مراجعة ما اختير وما استنتج منه.
- افصل خطأ العثور على الدليل عن خطأ استعماله؛ النتيجة ذات العنوان المناسب قد تخص حدثا آخر.
- راجع موضع كل موعد وحدود الدليل؛ إرفاق مرجع أو صياغة جواب مباشر لا يضمن الصحة.
أين تدخل مرحلة التوليد؟
تشرح AWS مسارا يسترجع مادة خارجية، ثم يضيفها إلى الطلب كي يستخدمها النموذج في توليد الجواب. وجود الاسترجاع وحده لا يصف مرحلة التوليد. [1]
لدينا برنامج افتراضي لمعرض أعمال يدوية. يسأل القارئ: «هل عرض الطباعة قبل استراحة الجولة؟». في المسار الأول تظهر نتيجة للبرنامج وأخرى لإعلان العارض. يفتح القارئ النصين ويقارن. في المسار الثاني تختار الخدمة مادة منهما، ثم تطلب من النموذج كتابة جواب. هذه مقارنة من تأليفنا، وليست تجربة على محرك بحث بعينه.
من يربط المعلومات في المسارين؟
يذكر البرنامج أن الطباعة في العاشرة، والاستراحة في الحادية عشرة. إذا وصل الموعدان من اليوم نفسه، نستطيع في المثال استنتاج أن العرض يسبق الاستراحة. قائمة النتائج لا تنجز هذه المقارنة لمجرد ظهور الملف، والجواب المباشر يحتاج سندا للموعدين حتى نراجع المقارنة.
في مسار RAG الكلاسيكي الذي تصفه Microsoft، يعيد البحث مجموعة نتائج ثم يمررها التطبيق إلى نموذج اللغة لصوغ استجابة. [2] قد يختار التطبيق بعض النتائج فقط. اطلب أن ترى المادة المعتمدة حين تسمح الأداة بذلك، ولا تعامل ترتيب الروابط أو طول الجواب بوصفه دليلا على اكتمال ما وصل.
كيف نفصل موضع الخطأ؟
افترض أن المادة المختارة إعلان لمعرض سابق، رغم أن عنوانه يذكر الطباعة. هنا نراجع اختيار المصدر واليوم قبل تحليل صياغة الجواب. وإذا وصل البرنامج الصحيح بموعد العاشرة، لكن الجواب قال الثانية عشرة، فلدينا خطأ في استعمال مادة وصلت بالفعل. الحالتان افتراضان للتوضيح ولم نرصدهما في نظام فعلي.
قد تعود المشكلة إلى الاثنين معا: وصل إعلان قديم، ثم أضاف الجواب اسم قاعة لا يذكره الإعلان. إصلاح البحث وحده لا يثبت صحة التفاصيل المضافة. سجل السؤال والمواد التي وصلت وعبارات الجواب، وفرق بين معلومة صريحة ومقارنة منطقية ومعلومة لا سند لها.
ما الذي يراجع القارئ عند النهاية؟
افتح موضع وقت الطباعة ووقت الاستراحة، وتحقق أن كليهما يخص الجولة المطلوبة. إذا غاب موعد الاستراحة، فالجواب المحدود هو أن المقارنة غير محسومة بالمادة المتاحة. لا تملأ الغياب بجدول حدث آخر لتبدو الإجابة مكتملة.
قائمة الروابط قد تعينك على اختيار ما تقرأ، والجواب المقترح قد يوفر صياغة للمقارنة. لكن المرجع يجب أن يدعم العبارة التي بجانبه، لا عنوان الموضوع فقط. هذا مسار مراجعة أصلي؛ لا يقيس المقال أي المسارين أسرع أو أدق، ولا يفترض أن عرض المصادر ميزة مضمونة في كل أداة.
المصادر ومتابعة القراءة
- AWS: What is Retrieval-Augmented Generation? — Retrieve and augment prompt (يفتح في نافذة جديدة)aws.amazon.com
- Microsoft Azure AI Search: RAG overview — Classic RAG (يفتح في نافذة جديدة)learn.microsoft.com
أُعدّ هذا المقال بصياغة عربية أصلية بالاستناد إلى المصادر أعلاه، وهو مدخل تمهيدي إلى الموضوع. اقرأ منهجية المحتوى وحدوده.
