مورد معجمي
في علم المعاجم الرقمية ، ومعالجة اللغة الطبيعية ، والعلوم الإنسانية الرقمية ، يُعد المورد المعجمي موردًا لغويًا يتكون من بيانات تتعلق بمفردات معجم لغة واحدة أو أكثر ، على سبيل المثال، في شكل قاعدة بيانات . [ 1 ]
صفات
توجد معايير مختلفة لإصدار الموارد المعجمية القابلة للقراءة آلياً، على سبيل المثال، إطار عمل ترميز المعجم (LMF) وهو معيار ISO لترميز الموارد المعجمية، ويتألف من نموذج بيانات مجرد وتسلسل XML ، [ 2 ] و OntoLex-Lemon ، وهو معجم RDF لنشر الموارد المعجمية كرسوم بيانية معرفية على الويب، على سبيل المثال، كبيانات مفتوحة مرتبطة لغوياً . [ 3 ]
بحسب نوع اللغات المُستهدفة، يُمكن تصنيف المورد المعجمي على أنه أحادي اللغة ، أو ثنائي اللغة ، أو متعدد اللغات . بالنسبة للموارد المعجمية ثنائية اللغة ومتعددة اللغات، قد تكون الكلمات متصلة أو غير متصلة بين اللغات. عند الاتصال، تتم المعادلة بين اللغات من خلال رابط ثنائي اللغة (كما في الموارد المعجمية ثنائية اللغة، باستخدام العلاقة vartrans:translatableAs في OntoLex-Lemon ) أو من خلال رموز متعددة اللغات (كما في الموارد المعجمية متعددة اللغات، بالإشارة إلى نفس ontolex:Concept في OntoLex-Lemon). [ 4 ]
من الممكن أيضًا بناء وإدارة مورد معجمي يتكون من معاجم مختلفة لنفس اللغة، على سبيل المثال، قاموس واحد للكلمات العامة وقاموس واحد أو عدة قواميس لمجالات متخصصة مختلفة.
القاموس القابل للقراءة آلياً مقابل قاموس معالجة اللغة الطبيعية
غالبًا ما يُشار إلى الموارد المعجمية في علم المعاجم الرقمي باسم القاموس المقروء آليًا ( MRD )، وهو قاموس مُخزَّن كبيانات حاسوبية بدلًا من طباعته على الورق. إنه قاموس إلكتروني وقاعدة بيانات معجمية. يُستخدم مصطلح القاموس المقروء آليًا عادةً في مقابل قاموس معالجة اللغة الطبيعية (NLP) ، حيث أن القاموس المقروء آليًا هو الشكل الإلكتروني للقاموس الذي كان يُطبع سابقًا على الورق. على الرغم من استخدام كلا المصطلحين في البرامج، إلا أن مصطلح قاموس معالجة اللغة الطبيعية (NLP) هو المُفضَّل عندما يُبنى القاموس من الصفر مع مراعاة معالجة اللغة الطبيعية. [ 5 ]
قاعدة بيانات معجمية
قاعدة البيانات المعجمية هي مورد معجمي مرتبط بقاعدة بيانات برمجية تتيح الوصول إلى محتوياته. قد تكون قاعدة البيانات مصممة خصيصًا للمعلومات المعجمية، أو قاعدة بيانات عامة تم إدخال المعلومات المعجمية فيها.
تتضمن المعلومات المخزنة عادة في قاعدة بيانات معجمية التهجئة والفئة المعجمية ومرادفات الكلمات، بالإضافة إلى العلاقات الدلالية والصوتية بين الكلمات المختلفة أو مجموعات الكلمات.
انظر أيضاً
- إطار عمل الترميز المعجمي (LMF) ، وهو معيار ISO لترميز الموارد المعجمية، ويتألف من نموذج بيانات مجرد وتسلسل XML
- OntoLex-Lemon ، مفردات RDF لنشر الموارد المعجمية على الويب، على سبيل المثال، كبيانات لغوية مفتوحة مرتبطة
- سلسلة مؤتمرات LREC
- قاموس قابل للقراءة آلياً
- وورد نت
- علم الوجود العربي
مراجع
- ↑ سارما، شيكار كر، وآخرون. بناء موارد معجمية متعددة اللغات باستخدام شبكات الكلمات: البنية والتصميم والتنفيذ . في: وقائع ورشة العمل الثالثة حول الجوانب المعرفية للمعجم . 2012. ص 161-170.
- ↑ فرانكوبولو، جيل؛ بيل، نوريا؛ جورج، مونتي؛ كالزولاري، نيكوليتا؛ موناتشيني، مونيكا؛ بيت، ماندي؛ سوريا، كلوديا (1 مارس 2009). "موارد متعددة اللغات لمعالجة اللغة الطبيعية في إطار الترميز المعجمي (LMF)" (ملف PDF) . موارد اللغة وتقييمها . 43 (1): 57-70 . doi : 10.1007/s10579-008-9077-5 . ISSN 1574-0218 . S2CID 7697316 .
- ↑ سيميانو، فيليب؛ كياركوس، كريستيان؛ مكراي، جون ب.؛ غراسيا، خورخي (2020)، البيانات اللغوية المرتبطة: التمثيل، والتوليد، والتطبيقات ، دار نشر سبرينغر الدولية، ص 45-59 ، doi : 10.1007/978-3-030-30225-2_4 ، ISBN 978-3-030-30225-2، S2CID 214148590
- ↑ سيميانو، فيليب؛ مكراي، جون ب.؛ بويتيلار، بول. "نموذج معجمي للأنطولوجيات: تقرير مجتمعي، 10 مايو 2016، التقرير النهائي لمجموعة المجتمع، 10 مايو 2016" . W3C . تم الاطلاع عليه في 6 ديسمبر 2019 .
- ↑ جيل فرانكوبولو (محرر) إطار عمل الترميز المعجمي LMF، ISTE / Wiley 2013 ( ISBN 978-1-84821-430-9)
روابط خارجية
- شبكة الكلمات الإنجليزية المفتوحة — نسخة مفتوحة المصدر من شبكة كلمات برينستون
- شبكات الكلمات في العالم في الرابطة العالمية لشبكات الكلمات
- موقع WordNet بجامعة برينستون (لم يعد يتم تحديثه)
- علم الوجود العربي في جامعة بيرزيت
- قواعد البيانات المعجمية
- المعجم (علم اللغة)
- قواعد بيانات الترجمة
- اللغويات الحاسوبية
- القواميس حسب النوع
