كاشف ADWIN في River يحتفظ بنافذة متكيفة ويقارن متوسطات أجزاء منها لرصد تغير. [1] عند مراقبة نموذج، نحتاج أيضا تعريف العدد الذي نغذيه به؛ إشارة حسابية على مؤشر معلن ليست تشخيصا تلقائيا لسبب تراجع التنبؤ.
الخلاصة السريعة
لا؛ الإشارة تخص ما قدم للكاشف وعقده. سجل تعريف العدد والإعداد ونتيجة التحديث الفعلية، ثم افصل اختلاف المتوسط عن تفسير السبب.
- يوثق River نافذة متغيرة تقارن متوسطات أجزاء منها، وتحديث ADWIN بقيمة عددية مفردة، مع drift_detected لآخر تحديث. [1]
- نرمز الصحيح بصفر والخطأ بواحد: قائمتنا الأولى 0 و 0 و 0 و 1 متوسطها 0.25، والثانية 0 و 1 و 1 و 1 متوسطها 0.75؛ فرق 0.5 حساب يدوي، لا ناتج كاشف شغلناه.
- لا يحدد ارتفاع مؤشر الخطأ هل تغيرت المدخلات أو مرجع التصحيح أو النموذج؛ بطاقة إشارة معلنة تختلف عن بطاقة لم نعرف نتيجة تحديثها.
- clock الافتراضي 32 يحدد دورية الفحص، وgrace_period الافتراضي 10 يمنع فحص التغير قبل وصول عدد البدء. [1] لا تعد كل تحديث فحصا أو تفترض كشفا فوريا من قائمتنا القصيرة.
ما العدد الذي ينظر إليه الكاشف؟
تصف وثائق River نافذة ADWIN المتغيرة ومقارنة متوسطات جزأين؛ update يستقبل قيمة عددية واحدة، وdrift_detected يصف الكشف بعد آخر تحديث. [1]
نقترح مراقبة أخطاء مصنف بطاقات، فنختار صفرا عندما يوافق التنبؤ مرجعا معتمدا وواحدا عندما يختلف عنه. هذه قاعدة إدخال نعلنها في المقال، لا بيانات خدمة أو وسم تلقائي لكل قيمة غائبة.
إذا قدمنا زمن الطلب بدلا من هذا المؤشر، أصبح العدد المراقب مختلفا. لا ننقل تفسير إشارة على زمن إلى دليل على صحة التصنيف. يلزم إبقاء اسم المؤشر ووحدته ومعيار تكوينه مع نتائج المراقبة.
ماذا تثبت قائمتا المؤشر المؤلفتان؟
نختار أربع قيم في أ: 0 و 0 و 0 و 1. مجموعها واحد ومتوسطها واحد على أربعة. ونختار أربع قيم أخرى في ب: 0 و 1 و 1 و 1. مجموعها ثلاثة ومتوسطها ثلاثة على أربعة. نفترض أن الحالات المرجعية معلومة وأن ترميز الصفر والواحد ثابت.
فرق المتوسطين 0.75 ناقص 0.25 يساوي 0.5. وفي هذا الترميز تختلف نسبة الأخطاء في القائمتين المعلنتين. لم نحدد أن أ وب هما الجزآن اللذان اختارهما تنفيذ ADWIN، ولم نقدم تحديثاته أو حالة نافذته.
لذلك لا نكتب «اكتشف عند القيمة الخامسة» أو «نقصت النافذة إلى أربع». الحساب يبين مادة يمكن أن تراقب، لكنه لا يستبدل آلية اختبار الكاشف أو يحدد نتيجة تشغيل لم ننفذه.
هل نعرف السبب من مؤشر الأخطاء؟
من الممكن في تصورنا أن تتغير بطاقات الإدخال، أو نسخة النموذج، أو قاعدة المرجع. لم نقدم سجلا يختار أي تفسير من هذه التفسيرات. الأصفار والآحاد تختصر موافقة تحت قاعدة، ولا تحفظ وحدها تلك التفاصيل.
نؤلف بطاقة متابعة تقول إن إشارة الكشف معلومة لآخر تحديث، وبطاقة أخرى لا تعرض نتيجته. الأولى تحفظ ما أعلنّاه، والثانية تبقى غير محسومة. لا نستبدل المجهول بقيمة غير صحيحة كي يبدو التقرير مستقرا.
وحتى في البطاقة ذات الإشارة، نراجع نسخ المؤشر والمرجع والمدخلات قبل قرار تغيير النموذج. لم ندع أن تجربة ضبط أجريت، أو أن كاشف المتوسط يثبت تغير علاقة كل مدخل بوسمه أو يحدد حلا ناجحا.
متى يحدث فحص التغير؟
clock الافتراضي في الصفحة 32، ويحدد كم مرة يفحص الكاشف التغير؛ وgrace_period الافتراضي 10 يحدد الحد الأدنى من القيم قبل أي فحص تغير. [1]
هذه إعدادات العقد المقروء، وليست أرقاما اخترناها لتحسين نموذج. لا نساوي إضافة قيمة بفحص مستقل في كل مرة، ولا نتوقع من مثال ذي ثماني قيم أن يقدم لنا كشفا وفق الإعداد الافتراضي. لم ننفذ أي تحديث.
نقترح أن تسجل المراجعة تعريف المؤشر وإعداد الكاشف ونتيجة آخر تحديث وما تغير في المصدر. الرسم يفصل فرق المتوسط الحسابي عن بطاقة الإشارة وعن تفسير السبب. هذا الفصل يجعل الإنذار قابلا للبحث، ويمنع تحويل كلمة «انحراف» إلى حكم مكتمل على خدمة النموذج.
المصادر ومتابعة القراءة
- River: ADWIN (يفتح في نافذة جديدة)riverml.xyz
أُعدّ هذا المقال بصياغة عربية أصلية بالاستناد إلى المصادر أعلاه، وهو مدخل تمهيدي إلى الموضوع. اقرأ منهجية المحتوى وحدوده.
