فور

FORR (للأسباب الصحيحة) هي بنية معرفية للتعلم وحل المشكلات، مستوحاة من أفكار هربرت أ. سيمون حول العقلانية المحدودة والاكتفاء بالحد الأدنى . طُوّرت لأول مرة في أوائل التسعينيات في جامعة مدينة نيويورك . وقد استُخدمت في ألعاب الفيديو ، وتحديد مسارات الروبوتات، وتصميم الحدائق الترفيهية، وأنظمة الحوار المنطوق ، وحل مسائل إرضاء القيود الصعبة (NP-hard) ، وهي عامة بما يكفي للعديد من تطبيقات حل المشكلات.

خلفية

العقلانية المحدودة

لا يمتلك نموذج FORR معرفة كاملة بكيفية حل المشكلة، بل يتعلم من التجربة. لا تُعدّ العوامل الذكية مثالية، بل تتخذ قراراتها بناءً على مجموعة فرعية فقط من جميع الأسباب الوجيهة والبيانات المفيدة المتاحة. ومع ذلك، يمكن اعتبار هذه العوامل عقلانية. وقد طرح هربرت أ. سيمون فكرة العقلانية المحدودة هذه [ 1 ] ، الذي وضع مع ألين نيويل الأسس الأولى لدراسة البنى المعرفية، كما ألهم بنىً مبكرة مثل Soar و ACT-R .

أسباب وجيهة متعددة

تعتمد نظرية FORR على فكرة وجود أسباب أو مبررات متعددة للقيام بأفعال معينة أثناء حل مشكلة ما. قد تكون هذه الأسباب صحيحة دائمًا (فمن الصواب دائمًا القيام بحركة في الشطرنج تضع الخصم في موقف كش ملك)، أو قد تكون صحيحة في بعض الأحيان فقط. الأسباب الصحيحة دائمًا هي الأقلية. أما الأسباب الصحيحة في بعض الأحيان، فقد تتنافس فيما بينها: على سبيل المثال، في لعبة الشطرنج، قد يكون أحد الأسباب الجيدة هو أسر القطع، بينما قد يكون سبب آخر هو السيطرة على منطقة معينة من رقعة الشطرنج. في نظرية FORR، تُسمى هذه الأسباب المتنافسة "المستشارين".

إن نظام المستشار المتدرج عام بما يكفي بحيث يمكن تطبيق أي سبب وجيه محتمل، مثل السبب الاحتمالي أو الاستنتاجي أو الإدراكي ، طالما أنه يقدم نصيحة بشأن تفضيله لفعل ما على آخر.

بسبب اعتمادها على مجموعة من الوكلاء المستقلين (المستشارين)، يمكن اعتبار FORR بنية اتصالية .

الهندسة المعمارية

يتكون هيكل FORR من ثلاثة مكونات: مجموعة من البيانات الوصفية التي تصف حالة المشكلة، ومجموعة متدرجة من المستشارين الذين يتم استشارتهم لتحديد الإجراء المطلوب تنفيذه، ونص برمجي سلوكي يستعلم من المستشارين وينفذ الإجراء الذي يقترحونه. [ 2 ]

المستشارون

المستشارون هم مجموعة من المبررات أو الأساليب الاستدلالية لاتخاذ القرار. ويمكن اعتبارهم بمثابة الذاكرة الإجرائية للبنية. عند كل قرار جديد، يتم الاستعلام من المستشارين لتحديد الإجراء المطلوب تنفيذه. لا يتواصل المستشارون فيما بينهم ولا يتعلمون ذاتيًا، بل يطلبون معلومات حول حالة المشكلة المخزنة في شكل بيانات وصفية، ويقدمون اقتراحًا بناءً على تلك المعلومات. ينقسم المستشارون إلى ثلاثة مستويات، ويتم الاستعلام عنها بالترتيب التالي:

  • المستوى الأول: هؤلاء المستشارون على صواب دائمًا. إذا اقترحوا إجراءً ما، يُنفَّذ هذا الإجراء فورًا وينتهي الاستفسار. أما إذا منعوا إجراءً ما، فيُستبعد هذا الإجراء من الدراسة. وإلا، يُنتقل إلى المستوى التالي.
  • المستوى الثاني: إذا تم تفعيل أحد هؤلاء المستشارين ، فإنه يقترح مشكلة فرعية، أو مجموعة مرتبة من الإجراءات، لتحقيق هدف فرعي في حل المشكلة الكلية (مثل تجاوز عائق واحد في متاهة). إذا لم يتم تفعيل أي مستشار من المستوى الثاني، فانتقل إلى المستوى الأخير.
  • المستوى الثالث: هذه كلها مبررات أخرى. ليست جميعها صحيحة، لكنها تتنافس فيما بينها. يتم التصويت على إجراء ما، ويتم تنفيذ الاقتراح الحائز على أعلى الأصوات. ستختلف أوزان فئات المشكلات المختلفة في نفس المجال لنفس المستشارين، وتُستمد هذه الأوزان من الخبرة من خلال خوارزميات التعلم .

الوصفيات

يمثل مكون الذاكرة التصريحي في البنية، والوصفات، حالة المشكلة وهي متاحة لأي مستشار.

سيناريو سلوكي

يستعلم البرنامج السلوكي من كل مستوى من مستويات المستشارين بالتتابع. إذا اقترح مستشار من المستوى الأول إجراءً ما، ينفذ البرنامج هذا الإجراء. أما إذا تم استدعاء مستشار من المستوى الثاني، فهذا يعني وجود مشكلة فرعية. يضمن وجود مستشار من المستوى الأول أن يكون مستشار واحد فقط من المستوى الثاني نشطًا في أي وقت. إذا لم يُبدِ أي مستشار من المستوى الأول أي تعليق، ولم يتم استدعاء أي مستشار من المستوى الثاني، يطلب البرنامج السلوكي اقتراحات أو تعليقات من جميع مستشاري المستوى الثالث، ويتيح لهم التصويت. ينفذ البرنامج الإجراء الحائز على أعلى نسبة تصويت من بين جميع مستشاري المستوى الثالث.

تطبيق بنية FORR

مجال المشكلة هو مجموعة من المشكلات المتشابهة، تُسمى فئات المشكلات. فإذا كان مجال المشكلة هو لعب ألعاب لوحية بسيطة، فإن لعبة إكس-أو تُعدّ فئة مشكلة، ولعبة واحدة منها تُمثّل حالة مشكلة. وإذا كان مجال المشكلة هو اجتياز متاهة، فإن متاهة مُحدّدة تُمثّل الفئة، ومحاولة واحدة لاجتيازها تُمثّل حالة مشكلة. بمجرد تحديد مجال المشكلة، يتضمن تطبيق بنية FORR لهذا المجال مرحلتين أساسيتين: إيجاد الأسباب الصحيحة المُحتملة (المستشارون) وتعلّم أوزانها لفئة مُحدّدة.

كيفية بناء بنية FORR

  1. حدد مجال المشكلة.
  2. استخدم معرفتك بالمجال ، ومراجعة الأدبيات، والحدس، والمنطق السليم لحصر قائمة بالأسباب المنطقية المحتملة لاتخاذ قرار، والتي قد تكون جيدة أو سيئة لفئات مختلفة ضمن المجال. هذه الأسباب المنطقية هي "المستشارون".
  3. قسّم المستشارين إلى مستويات:
    1. المستشارون الذين يكونون دائماً على صواب هم في المستوى الأول. على سبيل المثال، من الصواب دائماً القيام بخطوة رابحة في لعبة لوحية.
    2. ينتقل المستشارون الذين يحددون مشكلة فرعية إلى المستوى الثاني. على سبيل المثال، الالتفاف حول جدار في متاهة.
    3. جميع المستشارين الآخرين من المستوى الثالث.
  4. قم ببرمجة المستشارين. يُعيد كل مستشار مجموعة من الإجراءات المقترحة مع أوزان لكل إجراء مقترح. يتم تعيين الأوزان مبدئيًا إلى قيمة موحدة، مثل 0.05.
  5. حدد جميع المعلومات المتعلقة بحالة المشكلة التي يحتاجها جميع المستشارين. هذه هي المعلومات الوصفية. قم بترميزها.
  6. قم بكتابة البرنامج النصي السلوكي الذي يستفسر من المستشارين وينفذ الإجراء الذي يقترحونه.
  7. تعلم أوزان المستشارين على مجموعة من حالات المشاكل المحددة في مرحلة التعلم باستخدام خوارزمية التعلم المعزز .
  8. اختبر البنية على مجموعة من حالات المشاكل التي لم يسبق مواجهتها.

أوزان مستشار التعلم

تكون المستشارون متطابقين لجميع فئات المسائل في المجال، لكن الأوزان قد تختلف بين كل فئة ضمن المجال. قد لا تكون الاستدلالات المهمة للعبة إكس-أو مهمةً للعبة لوحية أخرى. يتعلم نموذج FORR أوزان مستشاريه من المستوى الثالث من خلال التجربة. تُخفَّض أوزان المستشارين الذين يقترحون إجراءً يؤدي إلى الفشل، بينما تُزاد أوزان المستشارين الذين تؤدي اقتراحاتهم إلى النجاح. تختلف خوارزميات التعلم بين التطبيقات.

التطبيقات

استُخدمت لغة FORR في تصميم الألعاب، وتحديد مسارات الروبوتات، وحل مشكلات إرضاء القيود ، وتصميم الحدائق، وأنظمة الحوار المنطوق . [ 3 ] [ 4 ]

انظر أيضاً

مراجع

  1. سيمون، هـ. أ. (1981) علوم المصنوعات
  2. إبستين (1992) الاستفادة من الصراع: هندسة فور المعمارية
  3. للاطلاع على أمثلة للتطبيقات، انظر الصفحة الرئيسية لـ FORR
  4. للاطلاع على استخدام FORR في أنظمة الحوار المنطوق، انظر FORRSooth في مشروع Loqui. مؤرشف بتاريخ 17 يوليو 2015 في Wayback Machine.
ملحوظات