Macro وMicro وWeighted أسماء لطرق مختلفة في تجميع مقاييس التصنيف. يميز المرجع المتوسط غير المرجح للفئات، والجمع قبل الحساب، والترجيح بعدد الحالات الفعلية لكل فئة. [1]
الخلاصة السريعة
حدد المقياس أولًا: في مثالنا نحسب الإحكام؛ Macro يساوي متوسط إحكام الفئات، وWeighted يرجحه بأعدادها الفعلية، وMicro يجمع عد الإصابات والأخطاء ثم يحسب الإحكام. [1]
- نحسب إحكام ثلاث فئات في مهمة ذات ملصق واحد لكل حالة، مع تضمين الفئات كلها ودون أوزان حالات إضافية؛ لا نخلط إحكامًا باسترجاع.
- في جدولنا إحكام الفئات أ وب وج هو 1 و 0.4 و 0.5؛ المتوسط غير المرجح Macro يساوي نحو 0.63333.
- أعداد الفئات الفعلية 6 و 3 و 1، ولذلك Weighted للإحكام يساوي 0.77؛ الأوزان ليست أعداد التنبؤات لكل فئة.
- الجمع يعطي ست إصابات صحيحة وأربع إيجابيات كاذبة عبر الفئات، فيكون Micro للإحكام 0.6؛ الدرجة المختلفة لا تعني تنبؤات جديدة.
سم المقياس والمهمة قبل المتوسط
تسمح الواجهة بتجميع الإحكام أو الاسترجاع أو درجة F بحسب اختيار المتوسط. Macro يعامل درجات الفئات بالتساوي، وWeighted يستخدم أعدادها الفعلية، وMicro يجمع العد أولًا. [1]
لن تكفي عبارة «المتوسط 0.7» دون تسمية المقياس وطريقة التجميع والفئات المشمولة. نستخدم هنا الإحكام فقط، وثلاث فئات متمايزة، وملصقًا فعليًا ومتنبأ به واحدًا لكل مثال. ولا نستبعد فئة من الحساب.
احسب ثلاث درجات ثم Macro
أنشأنا جدولًا لعشر قطع، وفئاتها أ وب وج. الصف يحمل الفئة الفعلية والعمود التنبؤ. الأعداد من إعدادنا وليست نتائج مصنف شغلناه.
لأ: إصابات صحيحة 3 وتنبؤات باسمها 3، فالإحكام 1. لب: إصابات 2 وتنبؤات 5، فالإحكام 0.4. لج: إصابة 1 وتنبؤان، فالإحكام 0.5. جمع 1 + 0.4 + 0.5 ثم القسمة على 3 يعطي Macro نحو 0.63333.
تساوت أوزان درجات الفئات الثلاث في هذا الحساب، رغم أن أ تظهر فعليًا أكثر من ج. لا يعني إعطاء الدرجة وزنًا مساويًا زيادة عدد حالات تلك الفئة أو ثبوت أدائها من عينة أكبر.
| الحقيقة / التنبؤ | أ | ب | ج |
|---|---|---|---|
| أ | 3 | 3 | 0 |
| ب | 0 | 2 | 1 |
| ج | 0 | 0 | 1 |
Weighted يزن الدرجات بأعداد الحقيقة
نجمع الصفوف لنجد أعداد الحالات الفعلية: أ لها 6، وب لها 3، وج لها 1. لذلك يصبح المتوسط المرجح للإحكام (6 × 1 + 3 × 0.4 + 1 × 0.5) ÷ 10 = 0.77.
لم نستخدم مجاميع الأعمدة 3 و 5 و 2 لترجيح الدرجات؛ تلك أعداد التنبؤات، وهي تختلف عن أعداد الحقيقة. استبدالها بالأوزان سيعطي تعريفًا آخر، ولن يكون Weighted الذي سميناه.
ارتفاع النتيجة عن Macro يأتي من وزن أ الأعلى مع إحكامها المرتفع في جدولنا. لم تتغير أي حالة أو تسمية، ولم تتحسن الفئة ج لأنها تلقت وزنًا أصغر. حافظ على درجات الفئات إذا كان نجاح كل منها مهمًا للمهمة.
Micro يجمع العد قبل القسمة
نجمع الإصابات الصحيحة عبر الفئات: 3 + 2 + 1 = 6. الإيجابيات الكاذبة بالنسبة إلى الفئات الثلاث مجموعها 0 + 3 + 1 = 4. فيكون الإحكام المجمع 6 ÷ (6 + 4) = 0.6.
في هذه المهمة ذات الملصق الواحد ومع تضمين الفئات كلها، كل خطأ يضيف إيجابية كاذبة إلى فئة متنبأ بها. لذلك يقابل مقامنا الحالات العشر. لا ننقل هذه المساواة تلقائيًا إلى إعداد يستبعد فئة أو يحمل عدة ملصقات أو أوزان حالات مختلفة.
لدينا الآن ثلاث نتائج للإحكام من الجدول نفسه: نحو 0.63333 و 0.77 و 0.6. الاختلاف جاء من السؤال الحسابي الذي طرحناه. لم نشغل واجهة تقييم؛ اختيار طريقة تلخيص يحتاج إلى هدف معروف، ولا يحسم أفضلية نموذج لمجرد أن إحدى قيمه أعلى.
المصادر ومتابعة القراءة
أُعدّ هذا المقال بصياغة عربية أصلية بالاستناد إلى المصادر أعلاه، وهو مدخل تمهيدي إلى الموضوع. اقرأ منهجية المحتوى وحدوده.
