فاصل نسبة النجاح يحتاج اسم طريقة الحساب إلى جانب مستوى الثقة. قد يشترك تقريران في عدد النجاحات والمحاولات، ثم يستعملان طريقتين مختلفتين لبناء الفاصل. نراجع إعدادات ثلاث طرق توثقها SciPy، ونميز النسبة المحسوبة مباشرة من حدود لم نحسبها في هذا المثال.
الخلاصة السريعة
اذكر الطريقة لأن exact وwilson وwilsoncc تعرّف إجراءات مختلفة؛ النسبة المرصودة ومستوى الثقة وحدهما لا يحددان أي إجراء استعملته. [1]
- نفترض محاولات مستقلة باحتمال نجاح ثابت مجهول. نثبت مثالًا مؤلفًا فيه نجاحان من ثماني محاولات؛ النسبة المرصودة 2/8 ، أي 0.25. لا نعرض هذا الرقم بوصفه حدود فاصل.
- تسمي SciPy طريقة Clopper-Pearson باسم exact، وWilson بلا تصحيح استمرارية باسم wilson، ومع التصحيح باسم wilsoncc؛ الافتراضي exact. [1]
- نقارن الطرق عند مستوى واحد مقداره 0.90 أولًا. تغيير الطريقة والمستوى معًا لا يعزل أثر أحدهما؛ سجل الإعدادين كلًا على حدة.
- يحمل المخرج low وhigh لحدي الفاصل. [1] احفظهما مع عدد النجاحات والمحاولات والطريقة والمستوى؛ لم نستخرج حدودًا عددية أو نشغل الواجهة هنا.
ما الذي يبقى ثابتًا قبل اختيار الطريقة؟
نؤلف سجلًا فيه ثماني محاولات، اثنتان منها نجاح وست إخفاقات. نعلن لغرض التمرين محاولات مستقلة باحتمال نجاح ثابت مجهول. النسبة التي نراها في السجل هي 2 مقسومة على 8 ، فتساوي 0.25.
نستطيع حساب هذه النسبة دون أن نقرر اسم طريقة الفاصل. لكن إذا كتبنا رقمين آخرين بوصفهما حدين، نحتاج أن نعرف كيف أتيا. تغيير اسم الطريقة لا يضيف نجاحًا إلى السجل ولا يغير العدد ثمانية.
هذا فصل بين وصف المدخل وبين إعداد إجراء استدلالي. لم نأخذ حالات من خدمة فعلية، ولم نثبت أن فرض ثبات احتمال النجاح يناسب كل مهمة ذكاء اصطناعي.
ماذا تعني أسماء الطرق الثلاث؟
توثق proportion_ci أسماء exact لطريقة Clopper-Pearson، وwilson لطريقة Wilson دون تصحيح استمرارية، وwilsoncc لطريقة Wilson مع التصحيح. والطريقة الافتراضية exact. [1]
نسجل الاسم الحرفي المستعمل، بدل الاكتفاء بعبارة «فاصل للنسبة». وجود cc يميز إجراءً يتضمن التصحيح، وليس اسمًا بديلًا للطريقة التي استبعدته.
لا نستنتج من اسم exact أن كل استنتاج عملي صار صحيحًا، ولا نرتب الطرق هنا حسب الأفضلية. سؤالنا محدود: هل يمكن للقارئ معرفة الطريقة من النسبة المرصودة وحدها؟ لا؛ سجل الإعداد هو الذي يجيب.
كيف نجعل المقارنة قابلة للتفسير؟
في الجدول نثبت النجاحين والمحاولات الثماني لجميع الصفوف. الصفوف أ وب وج تشترك أيضًا في مستوى 0.90 ؛ لذلك يختلف بينها إعداد الطريقة فقط.
الصف د يبقي wilsoncc ويغير المستوى إلى 0.95. مقارنة ج ود تعزل هذا التغيير في إعدادنا. أما مقارنة أ ود فتغير عاملين، فلا ننسب أي فرق محتمل في الحدود إلى الطريقة وحدها.
الجدول إعدادات مقارنة مقترحة، وليس نتائج استدعاءات. لذلك لم نملأه بحدود نخمنها، ولم نقل إن حدًا تغير بمقدار معين.
| سجل الإعداد | الطريقة | مستوى الثقة المعلن | النسبة المرصودة |
|---|---|---|---|
| أ | exact | 0.90 | 0.25 |
| ب | wilson | 0.90 | 0.25 |
| ج | wilsoncc | 0.90 | 0.25 |
| د | wilsoncc | 0.95 | 0.25 |
ماذا نحفظ مع الحدود عند تنفيذ الحساب؟
توثق الواجهة مخرجًا بخاصيتي low وhigh للحد السفلي والعلوي. [1]
نقترح أن يرافقهما عدد النجاحات والمحاولات، وتعريف النجاح، والطريقة ومستوى الثقة ونسخة الأداة. بذلك نعرف هل نقارن السجل نفسه أم إعدادين مختلفين أو بيانات تغيرت.
إذا وصلنا حدان بلا طريقة، نطلب سجل الحساب قبل إعادة تسميتهما. المثال لا يعطي فاصلًا محسوبًا ولا حكمًا على نموذج؛ إنه يوضح معلومات لا تستعيدها نسبة 0.25 بمفردها.
المصادر ومتابعة القراءة
- SciPy: proportion_ci (يفتح في نافذة جديدة)docs.scipy.org
أُعدّ هذا المقال بصياغة عربية أصلية بالاستناد إلى المصادر أعلاه، وهو مدخل تمهيدي إلى الموضوع. اقرأ منهجية المحتوى وحدوده.
