نت آول

NetOwl عبارة عن مجموعة من منتجات تحليل النصوص والهوية متعددة اللغات التي تحلل البيانات الضخمة في شكل بيانات نصية - التقارير، والويب، ووسائل التواصل الاجتماعي ، وما إلى ذلك - بالإضافة إلى بيانات الكيانات المنظمة حول الأشخاص والمنظمات والأماكن والأشياء.

تستخدم NetOwl مناهج الذكاء الاصطناعي، بما في ذلك معالجة اللغة الطبيعية والتعلم الآلي واللغويات الحاسوبية ، لاستخراج الكيانات والعلاقات والأحداث؛ ولتحليل المشاعر ؛ ولتحديد خطوط الطول والعرض للمراجع الجغرافية في النصوص؛ ولترجمة الأسماء المكتوبة بلغات أجنبية؛ ولمطابقة الأسماء والتحقق من الهوية . [ 1 ] [ 2 ] [ 3 ] تشمل استخدامات NetOwl البحث الدلالي والاكتشاف، [4] والتحليل الجغرافي المكاني، [ 5 ] وتحليل المعلومات الاستخباراتية، [ 6 ] وإثراء المحتوى، [ 7 ] ومراقبة الامتثال، [ 8 ] ومراقبة التهديدات السيبرانية، [ 9 ] وإدارة المخاطر، [ 10 ] والمعلوماتية الحيوية. [ 11 ]

تاريخ

كان أول منتج من منتجات NetOwl هو NetOwl Extractor، الذي أُطلق لأول مرة عام 1996. [ 12 ] ومنذ ذلك الحين، أُضيفت إلى Extractor العديد من الإمكانيات الجديدة، بما في ذلك استخراج العلاقات والأحداث، والتصنيف، وترجمة الأسماء، والوسم الجغرافي، وتحليل المشاعر، بالإضافة إلى استخراج الكيانات بلغات أخرى. وأُضيفت منتجات أخرى لاحقًا إلى مجموعة NetOwl، وهي TextMiner وNameMatcher وEntityMatcher.

شاركت NetOwl في العديد من فعاليات تقييم أداء برامج تحليل النصوص والكيانات التي ترعاها جهات خارجية. وقد حاز برنامج NetOwl Extractor على أعلى الدرجات في استخراج الكيانات المسماة في مؤتمر فهم الرسائل MUC-6 الذي ترعاه وكالة مشاريع الأبحاث الدفاعية المتقدمة (DARPA) ، كما حاز على أعلى الدرجات في استخراج الروابط والأحداث في مؤتمر MUC-7. [ 13 ] [ 14 ] وكان أيضًا النظام الأفضل أداءً في العديد من مهام تقييم استخراج المحتوى التلقائي (ACE) التي ترعاها المعهد الوطني للمعايير والتكنولوجيا (NIST) . [ 15 ] أما برنامج NetOwl NameMatcher فقد ​​حاز على أعلى الدرجات في تحدي MITRE لمطابقة أسماء الأشخاص متعددي الثقافات. [ 1 ]

منتجات

تتضمن مجموعة NetOwl، من بين أمور أخرى، منتجات تحليل النصوص والكيانات التالية:

تحليل النصوص

يقوم برنامج NetOwl Extractor باستخراج الكيانات من النصوص غير المهيكلة باستخدام معالجة اللغة الطبيعية (NLP) والتعلم الآلي (ML) واللغويات الحاسوبية . كما يقوم البرنامج باستخراج العلاقات الدلالية والأحداث، بالإضافة إلى تحديد الموقع الجغرافي للنصوص. [ 3 ] [ 5 ] يُستخدم البرنامج مع مصادر بيانات متنوعة، تشمل المصادر التقليدية (مثل الأخبار والتقارير وصفحات الويب والبريد الإلكتروني) ووسائل التواصل الاجتماعي (مثل تويتر وفيسبوك والمحادثات والمدونات). [ 8 ] يعمل البرنامج على منصات تحليل البيانات الضخمة المختلفة، بما في ذلك Apache Hadoop وتقنية الحوسبة عالية الأداء ( HPCC ) من LexisNexis. [ 7 ] تم دمج البرنامج مع عدد من أدوات التحليل الخارجية، مثل Esri ArcGIS وGoogle Earth/Maps. [ 5 ]

تحليلات الهوية

تُجري أدوات NetOwl NameMatcher وEntityMatcher مطابقة الأسماء وحلّ الهوية لقواعد بيانات الكيانات الكبيرة متعددة الثقافات واللغات باستخدام تقنيات التعلّم الآلي واللغويات الحاسوبية . [ 1 ] [ 2 ] وتُستخدم هذه الأدوات في تطبيقات مثل مكافحة غسل الأموال ، وقوائم المراقبة، والامتثال التنظيمي ، وكشف الاحتيال، وغيرها.

انظر أيضاً

مراجع

  1. 1 2 3 "SRA International". صحيفة واشنطن بوست. تم الاطلاع عليه بتاريخ 2013-07-02.
  2. 1 2 زيلينكو، ديمتري، وتشيناتسو أون. "أساليب تمييزية للترجمة الصوتية". في وقائع مؤتمر التطبيقات التجريبية لمعالجة اللغة الطبيعية لعام 2006 (2006). تم الاطلاع عليه بتاريخ 20 مايو 2013.
  3. 1 2 مايبوري، مارك (2012). استخراج المعلومات من الوسائط المتعددة ، هوبوكين، نيو جيرسي: جون وايلي وأولاده، ص 18. تم الاسترجاع في 2013-07-02.
  4. جاكسون، بيتر؛ مولينيه، إيزابيل (2002). معالجة اللغة الطبيعية للتطبيقات عبر الإنترنت: استرجاع النصوص واستخراجها وتصنيفها ، فيلادلفيا: جون بنجامينز بي في، ص 117، ISBN 90-272-4989-Xتم الاطلاع عليه بتاريخ 2013-07-02.
  5. 1 2 3 سميث، سوزان. "ملاحظات من ندوة GEOINT 2007". GISCafe (29-10-2007). تم الاطلاع عليه بتاريخ 2-7-2013.
  6. إندورخيا، نيتين وآخرون (2005). استخراج النصوص: أساليب تنبؤية لتحليل المعلومات غير المهيكلة ، نيويورك: سبرينغر، ص 154-155، ISBN 0-387-95433-3تم الاطلاع عليه بتاريخ 2013-07-02.
  7. 1 2 غيس، أنجيلا (19 يناير 2012). "ليكسيس نيكسيس تُصدر نسخة جديدة من ليكسيس أدفانس". semanticweb.com. تم الاطلاع عليه بتاريخ 28 يوليو 2013.
  8. 1 2 آون، تشيناتسو، وآخرون. "Assentor®: حل قائم على معالجة اللغة الطبيعية لمراقبة البريد الإلكتروني". في وقائع المؤتمر الوطني السابع عشر حول الذكاء الاصطناعي والمؤتمر الثاني عشر حول التطبيقات المبتكرة للذكاء الاصطناعي (2000)، الصفحات 945-540. تم الاطلاع عليه بتاريخ 20 مايو 2013.
  9. "داستي رودز وجيم مكلايف من شركة SRA: كيفية تعزيز الأمن السيبراني لشركتك". ExecutiveBiz (2009-07-02). تم الاطلاع عليه بتاريخ 2013-08-06.
  10. "ناسداك في حالة ترقب". سي إن إن موني (17 سبتمبر 1997). تم الاطلاع عليه بتاريخ 2 يوليو 2013.
  11. زاريمبا، سام، وآخرون. "استخراج النصوص من ملخصات PubMed باستخدام معالجة اللغة الطبيعية لإنشاء قاعدة معرفية عامة حول الآليات الجزيئية لمسببات الأمراض المعوية البكتيرية." BMC Bioinformatics، 10:177 (10-06-2009). تم الاطلاع عليه بتاريخ 20-05-2013.
  12. هودجينز-بونافيلد، كريستين. "أصبحت عملية تصفية المعرفة على الإنترنت أسهل". مؤرشف في 30 مارس 2003 على موقع Wayback Machine. الحوسبة الشبكية (31 مايو 1996). تم الاطلاع عليه في 3 سبتمبر 2013.
  13. سوندهايم، بيث م. "نظرة عامة على نتائج تقييم MUC-6". مؤرشف في 12 ديسمبر 2006 على موقع Wayback Machine. في وقائع المؤتمر السادس لفهم الرسائل (1995)، الصفحات 13-31. تم الاطلاع عليه في 20 مايو 2013.
  14. آون، تشيناتسو، وآخرون. "SRA: وصف نظام IE2 المستخدم في مؤتمر MUC-7". مؤرشف بتاريخ 9 ديسمبر 2006 في أرشيف الإنترنت (Wayback Machine) . ضمن وقائع المؤتمر السابع لفهم الرسائل (1998). تم الاطلاع عليه بتاريخ 20 مايو 2013.
  15. خطة تقييم ACE 2005 (ACE'05). تم الاطلاع عليها بتاريخ 20-05-2013.