اختيار عتبة التصنيف يحول درجات النموذج إلى أفعال أو ملصقات. يفرق التوثيق بين تقدير الدرجة الإحصائية واتخاذ القرار، ويعرض ضبط العتبة وفق مقياس محدد. [1]
الخلاصة السريعة
ثبت الدرجات، ثم أعلن هدف المقارنة والحدود المرشحة؛ في مثالنا نختار ما يصيب أكثر الحالات من ثلاثة حدود، على تحقق مستقل عن التدريب.
- تغيير حد القرار يغير الملصقات مع بقاء الدرجات ثابتة؛ لا يعني وحده تدريب نموذج جديد أو تحسين ترتيب الحالات. [1]
- على ست حالات متساوية الوزن وبقاعدة أكبر من أو يساوي، تعطي عتبات 0.6 و 0.5 و 0.3 ثلاثًا وأربعًا وخمس إصابات صحيحة بالترتيب.
- الهدف المعلن هو أكبر عدد من القرارات الصحيحة ضمن الحدود الثلاثة؛ لذلك نختار 0.3 هنا، دون إثبات أنه الحد الوحيد أو الأنسب لكل تكلفة.
- نضبط على بيانات تحقق جديدة بعد التدريب، ونحتاج إلى تقييم نهائي مستقل؛ لا نعيد استخدام مجموعة التدريب لاختيار العتبة. [1]
افصل تقدير الدرجة من قاعدة الاختيار
يوضح المرجع أن ضبط العتبة قد يبقي درجات الاحتمال والمنحنيات نفسها، بينما تتغير الفئات الناتجة. [1] لذلك نسجل قاعدة القرار بدل التعامل مع الملصق باعتباره خاصية ثابتة للدرجة.
نتخيل ست بطاقات في مجموعة تحقق منفصلة عن الحالات التي تعلم منها المصنف. لا نعيد ملاءمة النموذج أثناء المقارنة. درجتا 0.85 و 0.55 ودرجة 0.4 تخص إيجابيات فعلية، و 0.7 و 0.25 و 0.1 تخص سلبيات فعلية. جميع الحالات متساوية الوزن، والدرجة الأعلى تدعم اختيار الإيجابي.
عد الصحيح عند ثلاثة حدود
نعلن أن الحالة إيجابية إذا كانت الدرجة أكبر من العتبة أو مساوية لها. عند 0.6 نختار 0.85 و 0.7؛ الأولى صحيحة والثانية خطأ. نفوّت الإيجابيتين الأخريين ونصيب السلبيتين الباقيتين.
عند 0.5 تدخل الإيجابية 0.55، وعند 0.3 تدخل الإيجابية 0.4 أيضًا. لم تتغير درجة أو حقيقة؛ تغير فقط من تشملهم القاعدة.
يعرض الجدول عدًا مباشرًا من الحالات المفترضة. لم نشغل برنامج ضبط عتبات أو نقس أداء نظام مستخدم فعليًا.
| العتبة | TP | FP | FN | TN | القرارات الصحيحة |
|---|---|---|---|---|---|
| 0.6 | 1 | 1 | 2 | 2 | 3 من 6 |
| 0.5 | 2 | 1 | 1 | 2 | 4 من 6 |
| 0.3 | 3 | 1 | 0 | 2 | 5 من 6 |
أفضل ضمن أي قائمة ولأي هدف؟
حددنا هدفًا بسيطًا: تعظيم العدد غير المرجح للقرارات الصحيحة ضمن الحدود الثلاثة المعروضة. بهذا التعريف نختار 0.3. لم نعط الفائتة والخطأ الإيجابي تكاليف مختلفة، ولم نفرض سقفًا لعدد الحالات المختارة.
كما لم نبحث كل حد ممكن. أي عتبة أكبر من 0.25 وأصغر من 0.4 أو مساوية لها تعطي الملصقات نفسها في جدولنا. لذلك لا تثبت المقارنة أن 0.3 حل وحيد، ولا أن رقمًا بعينه يجب اعتماده لمهمة أخرى.
تغيير الهدف قد يغير الاختيار حتى مع الحالات نفسها. نحتاج إلى تسمية الهدف والمجموعة المرشحة قبل وصف حد بأنه أفضل، وإلى الاحتفاظ بأعداد نوعي الخطأ لفهم القرار.
افصل الضبط من إثبات الأداء
يحذر التوثيق من تدريب المصنف وضبط حد القرار على البيانات نفسها، بسبب فرط الملاءمة؛ وإعداد النموذج المدرب مسبقًا يحتاج إلى بيانات تحقق جديدة للضبط. [1]
لهذا وضعنا مجموعة تحقق مستقلة عن التدريب منذ بداية المثال. أما نتيجة خمس إصابات من ست، فهي نتيجة المقارنة التي اخترنا على أساسها الحد؛ لا نقدمها تقديرًا مضمونًا لأدائه على حالات لم نرها.
نثبت القرار المختار ثم نقيمه على مجموعة نهائية مستقلة بحسب تصميم المهمة. المثال اليدوي يشرح وظيفة الضبط، ولا يدعي نجاح تحقق نهائي أو تجربة تدريب. ومع تغير تعريف الإيجابي أو توزيع الحالات، نراجع صلاحية القاعدة بدل الاحتفاظ بالرقم دون سياقه.
المصادر ومتابعة القراءة
أُعدّ هذا المقال بصياغة عربية أصلية بالاستناد إلى المصادر أعلاه، وهو مدخل تمهيدي إلى الموضوع. اقرأ منهجية المحتوى وحدوده.
