خلاصة:
الهدف: تحسين استرجاع المعلومات الدلالية باستخدام طرق التصنيف وعلم التصنيف العلوي (أونتولوجيا). المنهجية: أجريت هذه الدراسة التطبيقية بنهج تحليل المحتوى. تم جمع 313 مقالة فارسية في موضوع استرجاع المعلومات في قاعدة بيانات تحتوي على قدرات بحث موضوعية لمجموعتي الاختبار القبلي والاختبار البعدي. بعد تصنيف 5700 كلمة بمساعدة برنامج معالجة اللغة الطبيعية لجامعة فردوسي مشهد، تم تصميم وتنفيذ علم التصنيف العلوي (أونتولوجيا) للمفاهيم والعلاقات الدلالية بينها في بيئة Protege. تم قياس دقة النتائج المسترجعة في مرحلتي الاختبار القبلي والاختبار البعدي. النتائج: أظهر مستوى الدلالة لاختبار Z من الناحية الإحصائية وثقة 0.99، وجود فرق ذو دلالة معنوية بين دقة النتائج المسترجعة المرتبطة في مجموعتي الاختبار القبلي والاختبار البعدي. لذلك، فإن هذه الأدوات تمتلك فعالية مقبولة. الاستنتاج: تقود طريقتا معالجة اللغة الطبيعية وعلم التصنيف العلوي (أونتولوجيا) إلى تحسين استرجاع المعلومات الدلالية.
ملخص الجهاز:
ومع تقدم أدوات الويب الدلالي، ساهم العاملون في قواعد البيانات من خلال إدخال الخصائص الدلالية في زيادة دقة النتائج المسترجعة من قواعد البيانات، ومن خلال إمكانية تعريف طلب بحث المستخدم باستخدام هذه الخصائص، فقد رفعوا مستوى فعالية أنظمة استرجاع المعلومات من وجهة نظر المستخدم؛ ونحن نسمي هذا العمل ارتقاء الاسترجاع الدلالي.
وتكون الأوسمة التالية مصاحبة لعملية الوسم: هذا البحث يسعى للإجابة على الأسئلة التالية: ما هي الأدوات والأساليب التي يمكن استخدامها لمعالجة اللغة الطبيعية للوثائق؟ ما هي العلاقات الدلالية الموجودة بين المفاهيم؟ ما هي الأساليب المستخدمة لتقييم أنظمة استرجاع المعلومات الدلالية؟ هل تؤدي أساليب معالجة اللغة الطبيعية والأنطولوجيا إلى تحسين استرجاع المعلومات الدلالية؟ من أجل تصميم أنظمة معالجة اللغة الطبيعية للنصوص الفارسية وكيفية وسم أجزائها ورسم الخرائط المفاهيمية، تم القيام بهذه الجهود: في نظام "Dena"، ومن خلال استخدام نظرية التبعية المفاهيمية، يتم تحويل الجمل الفارسية إلى شبكة من المفاهيم والعلاقات بينها؛ وتتمثل خطوات المعالجة في: التنقيب المعجمي، التنقيب الصرفي، التنقيب النحوي، التنقيب الدلالي والاستنتاج (Shahabi & Sarrafzadeh, 2001).