عامل بايز
عامل بايز هو نسبة بين نموذجين إحصائيين متنافسين، يُمثل كل منهما بأدلته ، ويُستخدم لتحديد مدى تفضيل أحد النموذجين على الآخر. [ 1 ] قد يشترك النموذجان في مجموعة من المعاملات، كفرضية العدم وفرضية بديلة، ولكن هذا ليس شرطًا؛ فعلى سبيل المثال، قد يكون النموذج غير خطي مقارنةً بتقريبه الخطي . يُمكن اعتبار عامل بايز نظيرًا بايزيًا لاختبار نسبة الاحتمال ، مع أنه يستخدم الاحتمال المُتكامل (أي الهامشي) بدلًا من الاحتمال المُعظم. ولذلك، لا تتطابق الكميتان إلا في ظل فرضيات بسيطة (مثل قيمتين محددتين للمعاملات). [ 2 ] كذلك، وعلى عكس اختبار دلالة فرضية العدم ، يدعم عامل بايز تقييم الأدلة المؤيدة لفرضية العدم، بدلًا من الاقتصار على رفضها أو عدم رفضها. [ 3 ]
على الرغم من بساطته المفاهيمية، قد يكون حساب عامل بايز صعبًا اعتمادًا على مدى تعقيد النموذج والفرضيات. [ 4 ] ولأن الصيغ المغلقة للاحتمالية الحدية غير متوفرة عمومًا، فقد اقتُرحت تقريبات عددية تستند إلى عينات سلسلة ماركوف مونت كارلو . [ 5 ] في بعض الحالات الخاصة، يمكن اشتقاق صيغ جبرية مبسطة؛ على سبيل المثال، نسبة كثافة سافاج-ديكي في حالة فرضية دقيقة (مقيدة بالمساواة) مقابل بديل غير مقيد. [ 6 ] [ 7 ] يُعرف تقريب آخر، مشتق بتطبيق تقريب لابلاس على الاحتمالات المتكاملة، بمعيار معلومات بايز (BIC)؛ [ 8 ] في مجموعات البيانات الكبيرة، يقترب عامل بايز من معيار معلومات بايز مع تضاؤل تأثير التوزيعات الاحتمالية المسبقة. في مجموعات البيانات الصغيرة، تكون المعلومات المسبقة مهمة بشكل عام ويجب ألا تكون غير مناسبة لأن عامل بايز سيكون غير معرف إذا لم يكن أي من التكاملين في نسبته محدودًا.
تعريف
عامل بايز هو نسبة احتمالين هامشيين؛ أي احتمالات نموذجين إحصائيين متكاملين على الاحتمالات المسبقة لمعلماتهما. [ 9 ]
الاحتمال اللاحقيتم تحديد نموذج M بالنظر إلى البيانات D بواسطة نظرية بايز :
المصطلح الرئيسي الذي يعتمد على البياناتيمثل احتمال إنتاج بعض البيانات في ظل افتراض النموذج M ؛ وتقييمه بشكل صحيح هو المفتاح لمقارنة النماذج البايزية.
بالنظر إلى مشكلة اختيار النموذج حيث يرغب المرء في الاختيار بين نموذجين بناءً على البيانات المرصودة D ، فإن معقولية النموذجين المختلفين M1 و M2 ، المحددين بواسطة متجهات معلمات النموذجويتم تقييمها بواسطة عامل بايز K المعطى بواسطة
عندما يكون للنموذجين احتمال مسبق متساوٍ، بحيثيُساوي عامل بايز نسبة الاحتمالات اللاحقة للنموذجين M1 و M2 . إذا استُخدمت دالة الاحتمال المقابلة لتقدير الاحتمال الأقصى للمعلمة لكل نموذج إحصائي بدلاً من تكامل عامل بايز، فإن الاختبار يتحول إلى اختبار نسبة الاحتمال الكلاسيكي . على عكس اختبار نسبة الاحتمال، لا تعتمد مقارنة النماذج البايزية هذه على أي مجموعة معلمات منفردة، إذ تُكامل على جميع المعلمات في كل نموذج (بالنسبة للاحتمالات المسبقة الخاصة بها). من مزايا استخدام عوامل بايز أنها تتضمن تلقائيًا، وبشكل طبيعي، عقوبةً لإدراج بنية نموذجية زائدة. [ 10 ] وبالتالي، فهي تحمي من التجاوز في التوفيق . بالنسبة للنماذج التي لا يتوفر فيها إصدار صريح من دالة الاحتمال أو يكون تقييمها عدديًا مكلفًا للغاية، يمكن استخدام الحساب البايزي التقريبي لاختيار النموذج في إطار بايزي، [ 11 ] مع التنبيه إلى أن تقديرات عوامل بايز التقريبية غالبًا ما تكون متحيزة. [ 12 ]
وتشمل الأساليب الأخرى ما يلي:
- التعامل مع مقارنة النماذج كمشكلة قرار ، وحساب القيمة المتوقعة أو تكلفة كل اختيار من النماذج؛
- لاستخدام الحد الأدنى لطول الرسالة (MML).
- استخدام الحد الأدنى لطول الوصف (MDL).
تفسير
قيمة K > 1 تعني أن البيانات قيد الدراسة تدعم الفرضية M1 بقوة أكبر من الفرضية M2 . تجدر الإشارة إلى أن اختبار الفرضيات التقليدي يُعطي فرضية واحدة (أو نموذجًا واحدًا) مكانةً مفضلة (الفرضية الصفرية)، ولا يأخذ في الاعتبار إلا الأدلة المُعارضة لها. إن قدرة عامل بايز على تقديم أدلة مؤيدة للفرضية الصفرية، وليس فقط أدلة مُعارضة لها، تُعد إحدى المزايا الرئيسية لأسلوب التحليل هذا. [ 13 ]
وضع هارولد جيفريز مقياسًا ( مقياس جيفريز ) لتفسير[ 14 ]
| ك | دهارت | أجزاء | قوة الأدلة |
|---|---|---|---|
| < 10 0 | < 0 | < 0 | سلبي (يدعم الفرضية M2 ) |
| من 10 إلى 10 ونصف | من 0 إلى 5 | من 0 إلى 1.6 | لا يستحق الذكر تقريبًا |
| من 10.5 إلى 10.1 | من 5 إلى 10 | من 1.6 إلى 3.3 | جوهري |
| من 10 1 إلى 10 3/2 | من 10 إلى 15 | من 3.3 إلى 5.0 | قوي |
| من 10 3/2 إلى 10 2 | من 15 إلى 20 | من 5.0 إلى 6.6 | قوي جداً |
| > 10 2 | > 20 | > 6.6 | حاسم |
يُبيّن العمود الثاني أوزان الأدلة المقابلة بوحدة ديسي هارتلي (المعروفة أيضًا باسم ديسي بان )؛ وتُضاف البتات في العمود الثالث للتوضيح. ويستمر الجدول في الاتجاه المعاكس، بحيث، على سبيل المثال،يُعدّ هذا دليلاً قاطعاً على.
تم تقديم جدول بديل، يتم الاستشهاد به على نطاق واسع، من قبل كاس ورافتر (1995): [ 10 ]
| log 10 K | ك | قوة الأدلة |
|---|---|---|
| من 0 إلى 1/2 | من 1 إلى 3.2 | لا يستحق أكثر من مجرد ذكر عابر |
| من نصف إلى واحد | من 3.2 إلى 10 | جوهري |
| من 1 إلى 2 | من 10 إلى 100 | قوي |
| > 2 | > 100 | حاسم |
بحسب آي جيه جود ، فإن الفرق الملحوظ لدى البشر في حياتهم اليومية، عندما يتعلق الأمر بدرجة تغير الإيمان بفرضية ما، يبلغ حوالي 1.3 ضعف، أو 1 ديسيب، أو 1/3 بت، أو من 1:1 إلى 5:4 في نسبة الاحتمالات. [ 15 ]
مثال
لنفترض أن لدينا متغيرًا عشوائيًا ينتج عنه إما نجاح أو فشل. نريد مقارنة نموذجحيث احتمال النجاح هو q = 1 ⁄ 2 ، ونموذج آخرحيث q غير معلومة، ونعتمد توزيعًا احتماليًا مسبقًا لـ q يكون منتظمًا على الفترة [0,1]. نأخذ عينة من 200، ونجد 115 حالة نجاح و85 حالة فشل. يمكن حساب الاحتمالية وفقًا للتوزيع ذي الحدين .
وهكذا لدينا لـ
أما بالنسبة لـلدينا
إذن، النسبة هي 1.2، وهي نسبة "لا تستحق الذكر" حتى لو كانت تشير بشكل طفيف جدًا إلى.
اختبار الفرضية التكرارية لـ(التي تُعتبر هنا فرضية العدم ) كانت ستؤدي إلى نتيجة مختلفة تمامًا. يقول هذا الاختبار أن يجب رفض الفرضية عند مستوى دلالة 5%، لأن احتمال الحصول على 115 نجاحًا أو أكثر من عينة مكونة من 200 إذا كانت q = 1/2 هو 0.02 ، بينما احتمال الحصول على قيمة متطرفة مساوية أو أكبر من 115 في اختبار ذي طرفين هو 0.04. تجدر الإشارة إلى أن 115 تبعد أكثر من انحرافين معياريين عن 100. وبالتالي، في حين أن اختبار الفرضية التكراري سيعطي نتائج دالة إحصائيًا عند مستوى دلالة 5%، فإن عامل بايز لا يعتبر هذه النتيجة متطرفة. مع ذلك، تجدر الإشارة إلى أن التوزيع الاحتمالي المسبق غير المنتظم (على سبيل المثال، التوزيع الذي يعكس توقع أن يكون عدد النجاحات والإخفاقات من نفس الرتبة) قد يؤدي إلى عامل بايز أكثر توافقًا مع اختبار الفرضية التكراري.
كان من الممكن أن يجد اختبار نسبة الاحتمال الكلاسيكي تقدير الاحتمال الأقصى لـ q ، أيومن ثم
(بدلاً من حساب المتوسط لجميع قيم q الممكنة ). وهذا يعطي نسبة احتمالية قدرها 0.1 ويشير إلى M 2 .
هو نموذج أكثر تعقيدًا منلأنها تحتوي على مُعامل حر يسمح لها بنمذجة البيانات بشكل أدق. إن قدرة عوامل بايز على أخذ هذا في الاعتبار هي أحد أسباب طرح الاستدلال البايزي كمبرر نظري وتعميم لمبدأ أوكام ، مما يقلل من أخطاء النوع الأول . [ 16 ]
من ناحية أخرى، تأخذ طريقة الاحتمال النسبي الحديثة في الحسبان عدد المعاملات الحرة في النماذج، على عكس نسبة الاحتمال الكلاسيكية. ويمكن تطبيق طريقة الاحتمال النسبي كما يلي: يحتوي النموذج M1 على صفر من المعاملات، وبالتالي فإن قيمة معيار معلومات أكايكي (AIC) الخاص به هييحتوي النموذج M2 على مُعامل واحد، وبالتالي فإن قيمة AIC الخاصة به هيوبالتالي فإن M 1 تقريبًااحتمالية M1 أعلى من احتمالية M2 لتقليل فقدان المعلومات. لذا، يُفضّل M2 قليلاً، لكن لا يمكن استبعاد M1 .
انظر أيضاً
- معيار معلومات أكايكي
- الحساب التقريبي باستخدام طريقة بايز
- معيار المعلومات البايزي
- معيار معلومات الانحراف
- مفارقة ليندلي
- الحد الأدنى لطول الرسائل
- اختيار الطراز
- القيمة الإلكترونية
- النسب الإحصائية
مراجع
- ↑ موري، ريتشارد د.؛ رومين، جان ويليم؛ رودر، جيفري ن. (2016). "فلسفة عوامل بايز وقياس الأدلة الإحصائية" . مجلة علم النفس الرياضي . 72 : 6-18 . doi : 10.1016/j.jmp.2015.11.001 . hdl : 11370/88f06270-40f8-49d2-bd02-d9b7edceccff .
- ↑ ليسافري، إيمانويل؛ لوسون، أندرو ب. (2012). "اختبار الفرضيات البايزية". الإحصاء الحيوي البايزي . سومرست: جون وايلي وأولاده. ص 72-78 . doi : 10.1002/9781119942412.ch3 . ISBN 978-0-470-01823-1.
- ↑ لي، ألكسندر؛ وآخرون (2020). "المنهجية البايزية للسير هارولد جيفريز كبديل عملي لاختبار فرضية قيمة P " . الدماغ والسلوك الحسابي . 3 (2): 153-161 . doi : 10.1007/s42113-019-00070-x . hdl : 2066/226717 .
- ↑ لورينتي، فرناندو؛ وآخرون (2023). "حساب الاحتمالية الهامشية لاختيار النموذج واختبار الفرضيات: مراجعة شاملة". مجلة SIAM Review . سيصدر قريباً: 3-58 . arXiv : 2005.08334 . doi : 10.1137/20M1310849 . S2CID 210156537 .
- ↑ كونغدون، بيتر (2014). "تقدير احتمالات النموذج أو الاحتمالات الحدية في الممارسة العملية". النمذجة البايزية التطبيقية ( الطبعة الثانية). وايلي. ص 38-40 . ISBN 978-1-119-95151-3.يُعدّ الأسلوب الذي اقترحه تشيب، سيدهارتا (1995). "الاحتمالية الحدية من مخرجات جيبس". مجلة الجمعية الإحصائية الأمريكية . 90 (432): 1313-1321 . doi : 10.2307/2291521 .تم توسيع نطاق هذه الطريقة لاحقًا لتشمل الحالات التي تُستخدم فيها خوارزميات أخذ العينات من نوع متروبوليس-هاستينغز، تشيب، سيدهارتا؛ جيليازكوف، إيفان (2001). "الاحتمالية الهامشية من مخرجات متروبوليس-هاستينغز". مجلة الجمعية الإحصائية الأمريكية . 96 (453): 270-281 . doi : 10.1198/016214501750332848 .
- ↑ كوب، غاري (2003). "مقارنة النماذج: نسبة كثافة سافاج-ديكي". الاقتصاد القياسي البايزي . سومرست: جون وايلي وأولاده. ص 69-71 . ISBN 0-470-84567-8.
- ↑ واجنماكرز، إريك-يان؛ لودويكس، توم؛ كوريال، هيمانشو؛ غراسمان، راؤول (2010). "اختبار الفرضيات البايزية لعلماء النفس: دليل تعليمي حول طريقة سافاج-ديكي" ( ملف PDF) . علم النفس المعرفي . 60 (3): 158-189 . doi : 10.1016/j.cogpsych.2009.12.001 . PMID 20064637. S2CID 206867662 .
- ↑ إبراهيم، جوزيف ج.؛ تشين، مينغ هوي؛ سينها، ديباجيوتي (2001). "مقارنة النماذج". تحليل البقاء البايزي . سلسلة سبرينغر في الإحصاء. نيويورك: سبرينغر. ص 246-254 . doi : 10.1007/978-1-4757-3447-8_6 . ISBN 0-387-95277-2.
- ↑ جيل، جيف (2002). "اختبار الفرضيات البايزية وعامل بايز". الأساليب البايزية : منهج العلوم الاجتماعية والسلوكية . تشابمان وهول. ص 199-237 . ISBN 1-58488-288-3.
- 1 2 روبرت إي. كاس وأدريان إي. رافتري (1995). "عوامل بايز" (ملف PDF) . مجلة الجمعية الإحصائية الأمريكية . 90 (430): 791. doi : 10.2307/2291091 . JSTOR 2291091 .
- ↑ توني، ت.؛ ستامبف، ماجستير في الصحة العامة (2009). "اختيار النموذج القائم على المحاكاة للأنظمة الديناميكية في بيولوجيا الأنظمة والسكان" . المعلوماتية الحيوية . 26 (1): 104-110 . arXiv : 0911.1705 . doi : 10.1093/bioinformatics/btp619 . PMC 2796821. PMID 19880371 .
- ↑ روبرت، سي بي؛ ج. كورنيت؛ ج. مارين؛ و إن إس بيلاي (2011). "انعدام الثقة في اختيار نموذج الحساب البايزي التقريبي" . وقائع الأكاديمية الوطنية للعلوم . 108 (37): 15112-15117 . Bibcode : 2011PNAS..10815112R . doi : 10.1073/pnas.1102900108 . PMC 3174657. PMID 21876135 .
- ↑ ويليامز، مات؛ باث، راسموس؛ فيليب، مايكل (2017). "استخدام عوامل بايز لاختبار الفرضيات في البحوث التنموية" . بحث في التنمية البشرية . 14 (4): 321-337 . doi : 10.1080/15427609.2017.1370964 .
- ↑ جيفريز، هارولد (1998) [1961]. نظرية الاحتمالات ( الطبعة الثالثة). أكسفورد، إنجلترا. ص 432. ISBN 9780191589676.
{{cite book}}: CS1 maint: موقع الناشر مفقود ( رابط ) - ↑ جود، آي جيه (1979). "دراسات في تاريخ الاحتمالات والإحصاء. 37 ميلادي: أعمال تورينج الإحصائية في الحرب العالمية الثانية" . بيومتريكا . 66 (2): 393-396 . doi : 10.1093/biomet/66.2.393 . MR 0548210 .
- ↑ شحذ شفرة أوكام على حزام بايزي
للمزيد من القراءة
- برناردو، ج.؛ سميث، أ. ف. م. (1994). نظرية بايز . جون وايلي. ISBN 0-471-92416-4.
- دينيسون، دي جي تي؛ هولمز، سي سي؛ ماليك، بي كيه؛ سميث، إيه إف إم (2002). الأساليب البايزية للتصنيف والانحدار غير الخطي . جون وايلي. ISBN 0-471-49036-9.
- دينيس، ز. (2019). كيف أعرف ما تتنبأ به نظريتي؟ التطورات في مناهج وممارسات العلوم النفسية doi : 10.1177/2515245919876960
- دودا، ريتشارد أو.؛ هارت، بيتر إي.؛ ستورك، ديفيد جي. (2000). "القسم 9.6.5". تصنيف الأنماط ( الطبعة الثانية). وايلي. الصفحات 487-489 . ISBN 0-471-05669-3.
- جيلمان، أ.؛ كارلين، ج.؛ ستيرن، هـ.؛ روبين، د. (1995). تحليل البيانات البايزي . لندن: تشابمان وهول . ISBN 0-412-03991-5.
- جاينز، إي تي (1994)، نظرية الاحتمالات: منطق العلم مؤرشف في 2018-10-24 في آلة Wayback ، الفصل 24.
- كادان، جوزيف ب.؛ ديكي، جيمس م. (1980). "نظرية القرار البايزية وتبسيط النماذج". في كمنتا، جان؛ رامزي، جيمس ب. (محرران). تقييم النماذج الاقتصادية القياسية . نيويورك: أكاديميك برس. ص 245-268 . ISBN 0-12-416550-8.
- لي، بي إم (2012). الإحصاء البايزي: مقدمة . وايلي. ISBN 9781118332573.
- ريتشارد، مارك؛ فيسر، جان (2021). "اختبار كفاءة أسواق التنبؤ: منهج مارتينجال، ونسبة الاحتمال، وتحليل عامل بايز" . المخاطر . 9 (2): 31. doi : 10.3390/risks9020031 . hdl : 10419/258120 .
- وينكلر، روبرت (2003). مقدمة في الاستدلال واتخاذ القرار البايزي ( الطبعة الثانية). الاحتمالات. ISBN 0-9647938-4-9.
روابط خارجية
- "BayesFactor" . مؤرشف من الأصل بتاريخ 21-06-2013.— حزمة برمجية بلغة R لحساب عوامل بايز في تصميمات البحث الشائعة
- "حاسبة عامل بايز" . مؤرشفة من الأصل بتاريخ 2015-05-07.— حاسبة إلكترونية لعوامل بايز المُستنيرة
- "حاسبات عامل بايز" . مؤرشف من الأصل بتاريخ 2015-05-07.— نسخة ويب من معظم حزمة BayesFactor
- الاستدلال البايزي
- اختيار الطراز
- النسب الإحصائية
