تقنية

النموذج الأساسي ونموذج المحادثة: اختلاف الاستخدام

تدريب نصي ينتج نموذجاً أساسياً تتبعه أمثلة محادثة لإنتاج نسخة مكيفة
رسم يميز مرحلة التدريب الأساسي عن تكييف المحادثة.

النموذج الأساسي ونموذج المحادثة قد ينتميان إلى العائلة نفسها، لكن مرحلة التدريب والغرض من الاستخدام يختلفان. يبدأ النموذج السببي بتدريب على النص، وقد يتبعه تدريب إضافي على رسائل المحادثة. [1]

الخلاصة السريعة

اقرأ وصف النسخة وطريقة تدريبها، ثم اختر صيغة الإدخال الملائمة للمهمة. كلمة «محادثة» تصف تكييفاً للاستخدام، ولا تثبت صحة كل جواب أو تفوق النسخة في كل عمل.

  • النموذج الأساسي نقطة انطلاق؛ وقد يضاف إليه تدريب على رسائل للمحادثة. [1]
  • التدريب الإضافي بأمثلة المهام يكيف النموذج، أما كتابة طلب جديد فلا تغير معاملاته بذاتها. [2]
  • صندوق الدردشة وحده لا يثبت وجود تدريب للمحادثة؛ افحص وصف النسخة وصيغة الإدخال.
  • في مثال استخراج عنوان، قارن النسخ على حالات واضحة ومعلنة بدلاً من الحكم من اسم النسخة.

ما المقصود بالنموذج الأساسي؟

تشرح وثائق Hugging Face أن التدريب المسبق على مجموعة نصوص ينتج نموذجاً أساسياً، وأن نماذج اللغة السببية تواصل تسلسل الرموز حتى بعد تكييفها للمحادثة. [1]

تخيل كاتباً يريد تجربة إكمال فقرة تبدأ بـ«في غرفة الرسم». الهدف في هذا المثال متابعة نص مفتوح. أما سؤاله «اشرح لي الفرق في ثلاث جمل» فيطلب استجابة لتعليمات. اختلاف المهمتين يساعدنا على قراءة وصف النموذج، دون افتراض أن كل نسخة أساسية عاجزة عن تنفيذ أي طلب.

ما الذي يضيفه التكييف للتعليمات؟

التدريب الإضافي يستخدم أمثلة مرتبطة بالمهمة لتعديل سلوك النموذج. وتوضح Google أن هندسة الطلبات لا تغير المعاملات؛ فهي تستعمل قدرات النموذج الموجود. لذلك يختلف عرض مثال داخل طلب عن تدريب نسخة جديدة عليه. [2]

في مثال مستقل، قد تتضمن بيانات التكييف طلباً لاستخراج عنوان وتوابعه بإجابة محددة. لكن المستخدم الذي يكتب «استخرج العنوان فقط» أمام نص واحد يوجه الاستخدام الحالي. عند وصف تطبيقك، سم الطريقة الصحيحة: هل غيرت نسخة النموذج بالتدريب، أم حسنت الطلب الذي تستعمله؟ الخلط يجعل تفسير النتائج أصعب.

هل واجهة الدردشة تكفي لمعرفة النوع؟

لنصمم تطبيقاً افتراضياً فيه صندوق رسالة وزر إرسال. شكل الشاشة لا يخبرنا بأي أوزان أو بيانات تدريب تعمل في الخلفية. قبل نسب خاصية إلى النموذج، ابحث عن اسم النسخة ووصفها لدى مطورها، وعن صيغة الرسائل التي تتوقعها واجهة الاستخدام.

إذا وردت كلمات مثل Base أو Instruct أو Chat في الاسم، عاملها كإشارة تحتاج قراءة الوصف. قد يوضح الوصف الغرض من التدريب والقالب المطلوب والقيود. لا تحول هذه الكلمات إلى ترتيب تلقائي من الأسوأ إلى الأفضل؛ المهمة التي سيؤديها التطبيق هي أساس المقارنة المقترحة هنا.

كيف نقارن النسختين على حاجة محددة؟

لنأخذ مهمة مصنوعة: استخراج عنوان إعلان دون سطر الشعار. جهز إعلاناً عادياً وآخر بلا عنوان وثالثاً بعنوانين. حدد مسبقاً أن الحالة الثانية تعاد بوصفها ناقصة، وأن الثالثة تحتاج سؤالاً توضيحياً. بعدها راجع ما إذا كانت الصياغة المطلوبة تتحقق في كل حالة.

لم نجر هذا الاختبار على نموذج فعلي، ولا نعرض نسب نجاح. المقصود اقتراح مقارنة يمكن مراجعتها: ثبت أمثلة التقييم، ووثق النسخة وطريقة الإدخال، ثم سجل الأخطاء المتعلقة بالمهمة. قد تحتاج اختياراً مختلفاً عندما تصبح المهمة إكمال قصة بدلاً من استخراج حقل؛ لا تنقل الحكم آلياً بين العملين.

المصادر ومتابعة القراءة

  1. Hugging Face: Chat templates — base and chat training (يفتح في نافذة جديدة)huggingface.co
  2. Google: النماذج اللغوية الكبيرة — الضبط الدقيق وهندسة الطلبات (يفتح في نافذة جديدة)developers.google.com

أُعدّ هذا المقال بصياغة عربية أصلية بالاستناد إلى المصادر أعلاه، وهو مدخل تمهيدي إلى الموضوع. اقرأ منهجية المحتوى وحدوده.