مقدر بايز
في نظرية التقدير ونظرية القرار ، يُعرف مُقدِّر بايز أو إجراء بايز بأنه مُقدِّر أو قاعدة قرار تُقلِّل القيمة المتوقعة اللاحقة لدالة الخسارة (أي الخسارة المتوقعة اللاحقة ). وبصورة مكافئة، يُعظِّم القيمة المتوقعة اللاحقة لدالة المنفعة . وهناك طريقة بديلة لصياغة المُقدِّر ضمن الإحصاءات البايزية، وهي تقدير القيمة اللاحقة القصوى .
تعريف
لنفترض وجود معلمة غير معروفةمن المعروف أن لها توزيعًا مسبقًا. يترككن مُقدِّراً لـ (بناءً على بعض القياسات x )، ولتكنقد تكون دالة خسارة ، مثل الخطأ التربيعي. مخاطرة بايز لـيُعرَّف بأنه، حيث يتم حساب التوقع على أساس التوزيع الاحتمالي لـوهذا يُعرّف دالة المخاطرة كدالة لـ. مُقدِّريُقال إن المقدر هو مقدر بايزي إذا قلل من مخاطرة بايز بين جميع المقدرات. أو بعبارة أخرى، هو المقدر الذي يقلل من الخسارة المتوقعة اللاحقة.لكلكما أنه يقلل من مخاطر بايز، وبالتالي فهو مقدر بايز. [ 1 ]
إذا كانت التوزيعة الاحتمالية المسبقة غير مناسبة، فإن المقدر الذي يقلل من الخسارة المتوقعة للتوزيعة الاحتمالية اللاحقة لكليُطلق عليه اسم مُقدِّر بايز المعمم . [ 2 ]
أمثلة
تقدير الحد الأدنى لمتوسط مربع الخطأ
تُعدّ دالة متوسط مربع الخطأ (MSE)، والتي تُسمى أيضًا دالة مخاطرة الخطأ التربيعي ، أكثر دوال المخاطرة شيوعًا في التقدير البايزي . ويتم تعريف متوسط مربع الخطأ (MSE) على النحو التالي:
حيث يتم حساب التوقع على التوزيع المشترك لـو.
المتوسط الخلفي
باستخدام متوسط مربع الخطأ كمخاطرة، فإن تقدير بايز للمعلمة المجهولة هو ببساطة متوسط التوزيع الخلفي ، [ 3 ]
يُعرف هذا باسم مقدر متوسط مربع الخطأ الأدنى (MMSE).
مقدرات بايز للتوزيعات الاحتمالية المسبقة المترافقة
إذا لم يكن هناك سبب جوهري لتفضيل توزيع احتمالي مسبق على آخر، يُختار أحيانًا توزيع احتمالي مسبق مترافق لتبسيط العملية. يُعرَّف التوزيع الاحتمالي المسبق المترافق بأنه توزيع مسبق ينتمي إلى عائلة بارامترية معينة ، وينتمي التوزيع الاحتمالي اللاحق الناتج عنه أيضًا إلى نفس العائلة. هذه خاصية مهمة، إذ يمكن اشتقاق مُقدِّر بايز، بالإضافة إلى خصائصه الإحصائية (التباين، وفترة الثقة، وما إلى ذلك)، من التوزيع الاحتمالي اللاحق.
تُعدّ التوزيعات الاحتمالية المسبقة المترافقة مفيدةً للغاية في التقدير التسلسلي، حيث يُستخدم التوزيع الاحتمالي اللاحق للقياس الحالي كتوزيع احتمالي مسبق في القياس التالي. في التقدير التسلسلي، ما لم يُستخدم توزيع احتمالي مسبق مترافق، يصبح التوزيع الاحتمالي اللاحق أكثر تعقيدًا مع كل قياس إضافي، ولا يمكن عادةً حساب مُقدِّر بايز دون اللجوء إلى الطرق العددية.
فيما يلي بعض الأمثلة على التوزيعات الاحتمالية المسبقة المترافقة.
- لوطبيعي ،، والوضع السابق طبيعي،إذا كان التوزيع الاحتمالي اللاحق طبيعيًا أيضًا، فإن مقدِّر بايز في ظل متوسط مربعات الخطأ يُعطى بالصيغة التالية:
- لوهي متغيرات عشوائية مستقلة ومتطابقة التوزيع من نوع بواسونوإذا كان التوزيع الاحتمالي المسبق يتبع توزيع جاماإذاً، فإن التوزيع الاحتمالي اللاحق يكون أيضاً توزيع غاما، ويُعطى مُقدِّر بايز في ظل متوسط مربع الخطأ بواسطة
- لوهي مستقلة وموزعة توزيعًا منتظمًاوإذا كان التوزيع المسبق يتبع توزيع باريتوإذاً، فإن التوزيع الاحتمالي اللاحق يتبع توزيع باريتو أيضاً، ويُعطى مُقدِّر بايز في ظل متوسط مربع الخطأ بواسطة
وظائف المخاطر البديلة
يتم اختيار دوال المخاطرة بناءً على كيفية قياس المسافة بين التقدير والمعلمة المجهولة. تُعدّ دالة متوسط مربعات الخطأ (MSE) أكثر دوال المخاطرة شيوعًا، ويعود ذلك أساسًا إلى بساطتها. مع ذلك، تُستخدم دوال مخاطرة بديلة أحيانًا. فيما يلي بعض الأمثلة على هذه البدائل. نرمز إلى دالة التوزيع المعمم اللاحق بـ.
الوسيط الخلفي والكميات الأخرى
دالة خسارة "خطية"، مع، مما ينتج عنه الوسيط الخلفي كتقدير بايز:
دالة خسارة "خطية" أخرى، تُعيّن "أوزاناً" مختلفة.يؤدي ذلك إلى التقدير الزائد أو الناقص. وينتج عنه كمية من التوزيع الاحتمالي اللاحق، وهو تعميم لدالة الخسارة السابقة:
الوضع الخلفي
تُعطي دالة الخسارة التالية النمط اللاحق في حالة الحد، في ظل ظروف معينة على الجزء الخلفي [ 4 ] :
أينثابت.
مقدرات Lp
يمكن للمرء أيضًا أن يفكرالمخاطرة التي يتم تحديد الخسارة من خلالها
أفضل لعبةقد يكون من الصعب تحديد خصائص المقدرات بصيغة مغلقة، إلا أنها تشترك في العديد من الخصائص المشابهة لتلك الموجودة في[ 5 ]
يمكن تصور دوال خسارة أخرى، على الرغم من أن متوسط مربع الخطأ هو الأكثر استخدامًا واعتمادًا. تُستخدم دوال خسارة أخرى في الإحصاء، وخاصة في الإحصاء القوي .
مقدرات بايز المعممة
التوزيع المسبقوقد افترض حتى الآن أن هذا التوزيع هو توزيع احتمالي حقيقي، بمعنى أن
مع ذلك، قد يكون هذا شرطًا مُقيِّدًا في بعض الأحيان. على سبيل المثال، لا يوجد توزيع (يشمل مجموعة الأعداد الحقيقية R ) يكون فيه احتمال كل عدد حقيقي متساويًا. ومع ذلك، يبدو هذا "التوزيع" من وجهة نظر معينة خيارًا طبيعيًا لتوزيع احتمالي أولي غير إعلامي ، أي توزيع احتمالي أولي لا يُشير إلى تفضيل أي قيمة مُحددة للمعلمة المجهولة. لا يزال بالإمكان تعريف دالة.لكن هذا لن يكون توزيعًا احتماليًا صحيحًا نظرًا لأن كتلته لا نهائية.
مثل هذه التدابيرأما التوزيعات التي لا تمثل توزيعات احتمالية، فيشار إليها باسم التوزيعات الاحتمالية المسبقة غير المناسبة .
يؤدي استخدام توزيع احتمالي مسبق غير مناسب إلى عدم تعريف مخاطرة بايز (لأن التوزيع المسبق ليس توزيعًا احتماليًا، ولا يمكننا حساب القيمة المتوقعة في ظله). ونتيجةً لذلك، لم يعد من المجدي الحديث عن مُقدِّر بايز يُقلِّل مخاطرة بايز. مع ذلك، في كثير من الحالات، يمكن تعريف التوزيع الاحتمالي اللاحق.
هذا تعريف، وليس تطبيقًا لنظرية بايز ، إذ لا يمكن تطبيق نظرية بايز إلا عندما تكون جميع التوزيعات صحيحة. مع ذلك، ليس من النادر أن يكون التوزيع الاحتمالي اللاحق الناتج توزيعًا احتماليًا صحيحًا. في هذه الحالة، الخسارة المتوقعة اللاحقة
عادةً ما تكون محددة جيدًا ومحدودة. تذكر أنه في حالة التوزيع الاحتمالي المسبق المناسب، يُقلل مُقدِّر بايز من الخسارة المتوقعة اللاحقة. أما عندما يكون التوزيع الاحتمالي المسبق غير مناسب، فيُشار إلى المُقدِّر الذي يُقلل من الخسارة المتوقعة اللاحقة باسم مُقدِّر بايز المُعمَّم . [ 2 ]
مثال
ومن الأمثلة النموذجية على ذلك تقدير معلمة الموقع باستخدام دالة خسارة من النوع. هناهو مُعامل الموقع، أي.
من الشائع استخدام الصيغة السابقة غير المناسبةفي هذه الحالة، وخاصة عندما لا تتوفر معلومات أخرى أكثر ذاتية. وهذا يؤدي إلى
وبالتالي الخسارة المتوقعة اللاحقة
مقدر بايز المعمم هو القيمةالذي يقلل من هذا التعبير لقيمة معينةوهذا يعادل تقليل
- بالنسبة لـ (1)
في هذه الحالة، يمكن إثبات أن مقدر بايز المعمم له الشكل التالي:، لبعض الثوابتلرؤية ذلك، دعلتكن القيمة التي تقلل (1) عندماثم، عند إعطاء قيمة مختلفةيجب علينا تقليل
- (2)
هذا مطابق لـ (1)، باستثناء أنتم استبدالها بـوبالتالي، فإن التعبير الذي يُقلل من قيمة الدالة يُعطى بالصيغة التالية:بحيث يكون للمُقدِّر الأمثل الشكل التالي
مقدرات بايز التجريبية
يُطلق على مُقدِّر بايز المُشتق باستخدام طريقة بايز التجريبية اسم مُقدِّر بايز التجريبي . تُتيح طرق بايز التجريبية استخدام بيانات تجريبية مساعدة، مُستقاة من مُلاحظات معلمات مُرتبطة، في تطوير مُقدِّر بايز. ويتم ذلك بافتراض أن المعلمات المُقدَّرة مُستمدة من توزيع احتمالي مُسبق مُشترك. على سبيل المثال، إذا أُجريت مُلاحظات مُستقلة لمعلمات مُختلفة، فإنه يُمكن أحيانًا تحسين أداء تقدير مُعلمة مُعينة باستخدام بيانات من مُلاحظات أخرى.
توجد مناهج بارامترية وغير بارامترية لتقدير بايز التجريبي. [ 6 ]
مثال
فيما يلي مثال بسيط على تقدير بايز التجريبي البارامتري. بالنظر إلى الملاحظات السابقةلها توزيع شرطييهتم المرء بتقديرمرتكز علىافترض أنلديهم سابقة مشتركةوالتي تعتمد على معلمات غير معروفة. على سبيل المثال، لنفترض أنتوزيع طبيعي بمتوسط غير معروفوالتباينيمكننا بعد ذلك استخدام الملاحظات السابقة لتحديد المتوسط والتباين لـبالطريقة التالية.
أولاً، نقوم بتقدير المتوسطوالتباينالتوزيع الهامشي لـباستخدام أسلوب الاحتمال الأقصى :
بعد ذلك، نستخدم قانون التوقع الكلي لحسابوقانون التباين الكلي لحساببحيث
أينوهي لحظات التوزيع الشرطي، والتي يُفترض أنها معلومة. على وجه الخصوص، لنفترض أنوذلكثم لدينا
وأخيرًا، نحصل على اللحظات المقدرة للتوزيع الاحتمالي المسبق.
على سبيل المثال، إذاوإذا افترضنا توزيعًا احتماليًا طبيعيًا مسبقًا (وهو توزيع احتمالي مترافق في هذه الحالة)، فإننا نستنتج أن، ومنها مقدر بايز لـمرتكز علىيمكن حسابها.
ملكيات
المقبولية
تُعتبر قواعد بايز ذات مخاطر بايز المحدودة مقبولة عادةً . وفيما يلي بعض الأمثلة المحددة لنظريات القبول.
- إذا كانت قاعدة بايز فريدة، فهي مقبولة. [ 7 ] على سبيل المثال، كما ذُكر أعلاه، في ظل متوسط مربع الخطأ (MSE)، تكون قاعدة بايز فريدة وبالتالي مقبولة.
- إذا كانت θ تنتمي إلى مجموعة منفصلة ، فإن جميع قواعد بايز مقبولة.
- إذا كانت θ تنتمي إلى مجموعة متصلة (غير منفصلة)، وإذا كانت دالة المخاطرة R(θ,δ) متصلة في θ لكل δ، فإن جميع قواعد بايز مقبولة.
في المقابل، غالبًا ما تنطوي قواعد بايز المعممة على مخاطر بايز غير محددة في حالة التوزيعات الاحتمالية المسبقة غير المناسبة. غالبًا ما تكون هذه القواعد غير مقبولة، وقد يكون التحقق من مقبوليتها أمرًا صعبًا. على سبيل المثال، يُعد مُقدِّر بايز المعمم لمعامل الموقع θ، المُستند إلى عينات غاوسية (الموصوف في قسم "مُقدِّر بايز المعمم" أعلاه)، غير مقبول لـوهذا ما يُعرف بظاهرة شتاين .
الكفاءة التقاربية
ليكن θ متغيرًا عشوائيًا مجهولًا، ولنفترض أنهل العينات مستقلة ومتطابقة التوزيع ذات كثافة. يتركلنفترض أن لدينا سلسلة من مُقدِّرات بايز لـ θ بناءً على عدد متزايد من القياسات. نهتم بتحليل الأداء التقاربي لهذه السلسلة من المُقدِّرات، أي أداءبالنسبة لقيم n الكبيرة .
ولهذا الغرض، من المعتاد اعتبار θ معلمة حتمية تكون قيمتها الحقيقيةفي ظل ظروف محددة، [ 8 ] بالنسبة للعينات الكبيرة (قيم n الكبيرة )، يكون التوزيع الاحتمالي اللاحق لـ θ طبيعيًا تقريبًا. بعبارة أخرى، بالنسبة لقيم n الكبيرة ، يكون تأثير الاحتمال المسبق على التوزيع اللاحق ضئيلاً. علاوة على ذلك، إذا كان δ هو مُقدِّر بايز في ظل مخاطر متوسط مربع الخطأ، فإنه يكون غير متحيز تقاربيًا ويتقارب في التوزيع مع التوزيع الطبيعي .
حيث I (θ 0 ) هي معلومات فيشر لـ θ 0. ويترتب على ذلك أن مقدر بايز δ n في ظل MSE يكون فعالاً تقاربياً .
يُعدّ مُقدِّر الاحتمال الأقصى (MLE) مُقدِّرًا آخر يتسم بالتوزيع الطبيعي التقاربي والكفاءة . ويمكن توضيح العلاقة بين مُقدِّر الاحتمال الأقصى ومُقدِّر بايز في المثال البسيط التالي.
مثال: تقدير قيمة p في التوزيع ذي الحدين
لنفترض مُقدِّر θ بناءً على عينة ذات الحدين x ~b(θ, n ) حيث θ تُمثِّل احتمال النجاح. بافتراض أن θ مُوزَّع وفقًا للتوزيع المسبق المترافق، وهو في هذه الحالة توزيع بيتا B( a , b )، فإن التوزيع اللاحق معروف بأنه B(a+x,b+nx). وبالتالي، فإن مُقدِّر بايز في ظل متوسط مربع الخطأ هو
إن تقدير الاحتمال الأقصى في هذه الحالة هو x/n، وبالتالي نحصل على:
تشير المعادلة الأخيرة إلى أنه بالنسبة لـ n → ∞، فإن مقدر بايز (في المشكلة الموصوفة) قريب من تقدير الاحتمال الأقصى.
من جهة أخرى، عندما تكون قيمة n صغيرة، تظل المعلومات المسبقة ذات صلة بمسألة القرار وتؤثر على التقدير. لمعرفة الوزن النسبي للمعلومات المسبقة، افترض أن a = b ؛ في هذه الحالة، يُضيف كل قياس بتًا واحدًا جديدًا من المعلومات؛ تُظهر الصيغة أعلاه أن للمعلومات المسبقة نفس وزن a + b بت من المعلومات الجديدة. في التطبيقات، غالبًا ما تكون المعلومات المتوفرة عن تفاصيل التوزيع المسبق قليلة جدًا؛ على وجه الخصوص، لا يوجد سبب للافتراض بأنه يتطابق تمامًا مع B( a , b ). في مثل هذه الحالة، أحد التفسيرات الممكنة لهذه الحسابات هو: "يوجد توزيع مسبق غير شاذ بمتوسط 0.5 وانحراف معياري d، مما يُعطي وزنًا للمعلومات المسبقة يساوي 1/(4d² ) - 1 بت من المعلومات الجديدة."
مثال آخر على هذه الظاهرة هو حالة التوزيع الطبيعي للتقدير المسبق والقياس. إذا كان التقدير المسبق متمركزًا عند النقطة B بانحراف معياري Σ، وكان القياس متمركزًا عند النقطة b بانحراف معياري σ، فإن التقدير اللاحق يكون متمركزًا عند النقطة b.حيث تكون الأوزان في هذا المتوسط المرجح α=σ² و β=Σ². علاوة على ذلك، فإن مربع الانحراف اللاحق هو Σ²+σ². بعبارة أخرى، يتم دمج الاحتمال المسبق مع القياس بنفس الطريقة تمامًا كما لو كان قياسًا إضافيًا يجب أخذه في الاعتبار.
على سبيل المثال، إذا كان Σ=σ/2، فإن انحراف 4 قياسات مجتمعة يطابق انحراف التوزيع الاحتمالي المسبق (بافتراض استقلال أخطاء القياسات). وتتوافق الأوزان α وβ في صيغة التوزيع الاحتمالي اللاحق مع هذا: وزن التوزيع الاحتمالي المسبق يساوي 4 أضعاف وزن القياس. وبدمج هذا التوزيع الاحتمالي المسبق مع n قياسات بمتوسط v ، نحصل على توزيع احتمالي لاحق متمركز عندوعلى وجه الخصوص، يؤدي الاحتمال المسبق نفس دور أربع قياسات أُجريت مسبقًا. وبشكل عام، يكون للاحتمال المسبق وزن يساوي (σ/Σ)² من القياسات.
بالمقارنة مع مثال التوزيع ذي الحدين: هناك، يكون للتوزيع المسبق وزن (σ/Σ)²−1 قياسًا. يمكن ملاحظة أن الوزن الدقيق يعتمد على تفاصيل التوزيع، ولكن عندما يكون σ≫Σ، يصبح الفرق ضئيلاً.
مثال عملي على مقدرات بايز
تستخدم قاعدة بيانات الأفلام على الإنترنت (IMDb) صيغةً لحساب ومقارنة تقييمات الأفلام من قِبل مستخدميها، بما في ذلك قائمة أفضل 250 فيلمًا ، والتي يُزعم أنها تُعطي "تقديرًا بايزيًا دقيقًا". [ 9 ] استُخدمت الصيغة البايزية التالية في البداية لحساب متوسط مرجح لأفضل 250 فيلمًا، إلا أن الصيغة قد عُدّلت منذ ذلك الحين:
أين:
- = التقييم المرجح
- = متوسط تقييم الفيلم كرقم من 1 إلى 10 (المتوسط) = (التقييم)
- عدد الأصوات/التقييمات للفيلم = (أصوات)
- = الوزن المعطى للتقدير السابق (في هذه الحالة، عدد الأصوات التي اعتبرها موقع IMDB ضرورية لكي يقترب متوسط التقييم من الصلاحية الإحصائية)
- = متوسط التصويت عبر المجموعة بأكملها (حالياً 7.0)
لاحظ أن W هو ببساطة المتوسط الحسابي المرجح لـ R و C باستخدام متجه الأوزان (v, m) . عندما يتجاوز عدد التقييمات m ، تتجاوز ثقة متوسط التقييم ثقة متوسط التصويت لجميع الأفلام (C)، ويقترب التقييم المرجح (W) من المتوسط الحسابي (R). كلما اقترب v (عدد تقييمات الفيلم) من الصفر، اقترب W من C ، حيث W هو التقييم المرجح و C هو متوسط تقييم جميع الأفلام. بعبارة أبسط، كلما قل عدد التقييمات/التصويتات لفيلم ما، كلما اقترب تقييمه المرجح من المتوسط الحسابي لجميع الأفلام، بينما تقترب تقييمات الأفلام ذات التقييمات/التصويتات الكثيرة من متوسطها الحسابي.
يضمن نهج IMDb أن الفيلم الذي حصل على عدد قليل من التقييمات، وكلها عند 10، لن يحتل مرتبة أعلى من فيلم "العراب"، على سبيل المثال، الذي حصل على متوسط 9.2 من أكثر من 500000 تقييم.
انظر أيضاً
ملحوظات
- ↑ ليمان وكاسيلا، النظرية 4.1.1
- 1 2 ليمان وكاسيلا، التعريف 4.2.9
- ↑ جاينز ، إي تي (2007). نظرية الاحتمالات: منطق العلم (الطبعة الخامسة المطبوعة). كامبريدج [ua]: مطبعة جامعة كامبريدج. ص 172. ISBN 978-0-521-59271-0.
- ↑ باسيت، روبرت؛ ديريد، خوليو (مارس 2019). "مُقدِّرات الاحتمال اللاحق الأقصى كحدٍّ لمُقدِّرات بايز". البرمجة الرياضية . 174 ( 1-2 ): 129-144 . arXiv : 1611.05917 . doi : 10.1007/s10107-018-1241-0 .
- ↑ ديتسو، أ.؛ بوستين، ر.؛ تونينيتي، د.؛ ديفروي، ن.؛ بور، هـ. ف.؛ شماي شيتز، س. (2018). "حول الحد الأدنى لمتوسط الخطأ من الرتبة p في قنوات الضوضاء الغاوسية وتطبيقاته". معاملات IEEE في نظرية المعلومات . 64 (3). IEEE : 2012-2037 . arXiv : 1607.01461 . doi : 10.1109/TIT.2017.2782786 .
- ↑ بيرغر (1980)، القسم 4.5.
- ↑ ليمان وكاسيلا (1998)، النظرية 5.2.4.
- ↑ ليمان وكاسيلا (1998)، القسم 6.8
- ↑ "أفضل 250 فيلمًا على موقع IMDb" . مؤرشف من الأصل بتاريخ 2012-06-01.
مراجع
- بيرغر، جيمس أو. (1985). نظرية القرار الإحصائي والتحليل البايزي ( الطبعة الثانية). نيويورك: سبرينغر-فيرلاغ. ISBN 0-387-96098-8MR 0804611 .
- ليمان، إي إل؛ كاسيلا، جي. (1998). نظرية التقدير النقطي ( الطبعة الثانية). سبرينغر. ISBN 0-387-98502-6.
- بيلز، يورغن (1991). "التقدير البايزي". التقدير البايزي والتصميم التجريبي في نماذج الانحدار الخطي . تشيتشستر: جون وايلي وأولاده. ص 38-117 . ISBN 0-471-91732-X.
روابط خارجية
- "المُقدِّر البايزي" ، موسوعة الرياضيات ، دار نشر EMS، 2001 [1994]
- المُقدِّر
- التقدير البايزي
