البيانات شبه المنظمة

البيانات شبه المنظمة [1] هي شكل من أشكال البيانات المنظمة التي لا تتبع البنية الجدولية لنماذج البيانات المرتبطة بقواعد البيانات العلائقية أو أشكال أخرى من جداول البيانات ، ولكنها مع ذلك تحتوي على علامات أو علامات أخرى لفصل العناصر الدلالية وفرض التسلسل الهرمي للسجلات والحقول داخل البيانات. لذلك، تُعرف أيضًا باسم البنية التي تصف نفسها .

في البيانات شبه المنظمة، قد يكون للكيانات التي تنتمي إلى نفس الفئة سمات مختلفة حتى لو تم تجميعها معًا، ولا يعد ترتيب السمات مهمًا.

أصبحت البيانات شبه المنظمة شائعة بشكل متزايد منذ ظهور الإنترنت حيث لم تعد المستندات النصية الكاملة وقواعد البيانات هي الأشكال الوحيدة للبيانات بعد الآن، وتحتاج التطبيقات المختلفة إلى وسيط لتبادل المعلومات . في قواعد البيانات الموجهة للكائنات ، غالبًا ما نجد بيانات شبه منظمة.

أنواع

إكس إم إل

XML ، [2] ولغات الترميز الأخرى، والبريد الإلكتروني ، و EDI كلها أشكال من البيانات شبه المنظمة. تم إنشاء OEM (نموذج تبادل الكائنات) [3] قبل XML كوسيلة لوصف بنية البيانات ذاتيًا. تم تعميم XML من خلال خدمات الويب التي تم تطويرها باستخدام مبادئ SOAP .

تعاني بعض أنواع البيانات الموصوفة هنا بأنها "شبه منظمة"، وخاصة XML، من الانطباع بأنها غير قادرة على تحقيق الدقة البنيوية على نفس المستوى الوظيفي مثل الجداول والصفوف العلائقية. والواقع أن النظرة إلى XML باعتبارها شبه منظمة بطبيعتها (في السابق، كانت تُشار إليها باعتبارها "غير منظمة") أعاقت استخدامها لمجموعة متزايدة الاتساع من التطبيقات التي تركز على البيانات. وحتى المستندات، التي يُنظر إليها عادةً على أنها تجسيد للبنية شبه المنظمة، يمكن تصميمها بنفس الدقة تقريبًا مثل مخطط قاعدة البيانات ، والتي يتم فرضها بواسطة مخطط XML ومعالجتها بواسطة برامج تجارية ومخصصة دون تقليل قابليتها للاستخدام من قبل القراء البشر.

في ضوء هذه الحقيقة، يمكن الإشارة إلى XML باعتباره "بنية مرنة" قادرة على التدفق والتسلسل الهرمي المرتكز على الإنسان بالإضافة إلى بنية العناصر وكتابة البيانات الصارمة للغاية.

ولكن مفهوم XML باعتباره "قابلاً للقراءة من قِبَل البشر" لا يمكن أن يُؤخذ إلى هذا الحد. فبعض التطبيقات/اللهجات الخاصة بلغة XML، مثل التمثيل XML لمحتويات مستند Microsoft Word، كما تم تنفيذه في Office 2007 والإصدارات اللاحقة، تستخدم عشرات أو حتى مئات الأنواع المختلفة من العلامات التي تعكس مجال مشكلة معين ـ في حالة Word، التنسيق على مستوى الحرف والفقرة والمستند، وتعريفات الأنماط، وإدراج الاستشهادات، وما إلى ذلك ـ والتي تتداخل مع بعضها البعض بطرق معقدة. ومن المستحيل فهم حتى جزء من مثل هذا المستند XML من خلال قراءته، ناهيك عن اكتشاف الأخطاء في بنيته، دون فهم عميق مسبق لتطبيق XML المحدد، إلى جانب المساعدة من قِبَل برنامج يفهم مخطط XML الذي تم استخدامه. ومثل هذا النص ليس "مفهوماً من قِبَل البشر" تماماً كما أن الكتاب المكتوب باللغة السواحيلية (التي تستخدم الأبجدية اللاتينية) ليس مفهوماً بالنسبة لأميركي أو أوروبي غربي لا يعرف كلمة واحدة من تلك اللغة: فالعلامات عبارة عن رموز لا معنى لها بالنسبة لشخص غير مألوف بهذا المجال.

جيسون

JSON أو JavaScript Object Notation هو تنسيق قياسي مفتوح يستخدم نصًا يمكن قراءته بواسطة الإنسان لنقل كائنات البيانات. تم تعميم JSON من خلال خدمات الويب التي تم تطويرها باستخدام مبادئ REST .

تخزن قواعد البيانات مثل MongoDB و Couchbase البيانات بشكل أصلي بتنسيق JSON، مما يتيح الاستفادة من مزايا بنية البيانات شبه المنظمة.

الايجابيات والسلبيات

المزايا

  • لا يحتاج المبرمجون الذين يحتفظون بالكائنات من تطبيقهم إلى قاعدة بيانات إلى القلق بشأن عدم تطابق معاوقة العلاقة بين الكائن والعلاقة ، ولكن يمكنهم غالبًا تسلسل الكائنات عبر مكتبة خفيفة الوزن.
  • غالبًا ما يؤدي دعم البيانات المتداخلة أو الهرمية إلى تبسيط نماذج البيانات التي تمثل العلاقات المعقدة بين الكيانات.
  • يؤدي دعم قوائم الكائنات إلى تبسيط نماذج البيانات من خلال تجنب الترجمات الفوضوية للقوائم إلى نموذج بيانات علائقي.

العيوب

  • يحتوي نموذج البيانات العلائقية التقليدي على لغة استعلام شائعة وجاهزة، وهي SQL .
  • عرضة لـ "القمامة الداخلة والقمامة الخارجة"؛ من خلال إزالة القيود من نموذج البيانات، هناك حاجة إلى قدر أقل من التفكير المسبق لتشغيل تطبيق البيانات.

نموذج شبه منظم

النموذج شبه المنظم هو نموذج قاعدة بيانات حيث لا يوجد فصل بين البيانات والمخطط ، وتعتمد كمية الهيكل المستخدم على الغرض.

ومن مميزات هذا النموذج ما يلي:

  • يمكنه تمثيل معلومات بعض مصادر البيانات التي لا يمكن تقييدها بالمخطط.
  • إنه يوفر تنسيقًا مرنًا لتبادل البيانات بين أنواع مختلفة من قواعد البيانات.
  • قد يكون من المفيد عرض البيانات المنظمة على أنها شبه منظمة (لأغراض التصفح).
  • يمكن تغيير المخطط بسهولة.
  • قد يكون تنسيق نقل البيانات قابلاً للنقل.

تتمثل المقايضة الأساسية التي يتم إجراؤها عند استخدام نموذج قاعدة بيانات شبه مهيكلة في أنه لا يمكن إجراء الاستعلامات بكفاءة كما هو الحال في بنية أكثر تقييدًا، مثل النموذج العلائقي . عادةً ما يتم تخزين السجلات في قاعدة بيانات شبه مهيكلة بمعرفات فريدة يتم الرجوع إليها باستخدام مؤشرات إلى موقعها على القرص. وهذا يجعل الاستعلامات القائمة على التنقل أو المسار فعالة للغاية، ولكن لإجراء عمليات بحث على العديد من السجلات (كما هو معتاد في SQL )، فهي ليست فعالة لأنها يجب أن تبحث حول القرص باتباع المؤشرات.

نموذج تبادل الكائنات (OEM) هو أحد المعايير للتعبير عن البيانات شبه المنظمة، وهناك طريقة أخرى وهي XML .

انظر أيضا

مراجع

  1. ^ بيتر بونمان (1997). "البيانات شبه المنظمة" (PDF) . ندوة حول مبادئ أنظمة قواعد البيانات .
  2. ^ مجموعة قاعدة بيانات بن لديها مشروع بيانات شبه مهيكلة وXML
  3. ^ جامعة ستانفورد لور DBMS
  • مجموعة قاعدة بيانات جامعة بنسلفانيا – البيانات شبه المنظمة وXML
  • تحليلات البيانات شبه المنظمة: منصة علائقية أم منصة Hadoop؟ من IBM
تم الاسترجاع من "https://en.wikipedia.org/w/index.php?title=بيانات_شبه_مهيكلة&oldid=1242458881#نموذج_شبه_مهيكل"
Original text
Rate this translation
Your feedback will be used to help improve Google Translate