تغییر رویکرد نظامهای اطلاعاتی از پردازش واژه به پردازش مفهوم، موجب توجه به هستیشناسیها شده است. در علوم پزشکی و بیماریهای انسان، به لحاظ وجود تنوع در اصطلاحات و لزوم اشتراک اطلاعات از طریق نرمافزارهای مختلف مانند پروندههای پزشکی، سامانههای ثبت سوابق بهداشتی و... بکارگیری هستیشناسیها ضروری بهنظر میرسد. در پژوهش حاضر، رویکردی نیمهخودکار برای توسعه هستیشناسی پیشنهاد شده است که میتواند با استفاده از ابزارهای متنکاوی، شناسایی مولفههای ساختاری هستیشناسی و تعیین نسبی روابط را از متون علمی تسهیل کند. مدل پیشنهادی در قالب کد نرمافزاری با نام اختصاری «TmbOnt_Alfa[1]» ارائه شده است. این کد با استفاده از رابط کاربر، فایل متنی ورودی را فراخوانی کرده و پس از پردازش بر اساس تنظیمات، اصطلاحات کلیدی برای توسعه هستیشناسی را استخراج میکند. به منظور ارزیابی کارایی روش پیشنهادی، مطالعه موردی در حوزه بیماری «گلوکوم» با دادههای متنی مشتمل بر10،000 چکیده مقاله از «PubMed» برمبنای جستوجوی واژگانی تهیه گردید. پس از مراحل پردازش، مفاهیم و ساختار سلسله مراتبی هستیشناسی حاصل در پروتژ وارد شد. سرانجام، سنجش قیاسی هستیشناسی توسعهیافته با سرعنوان پزشکی «MESH»، «اصطلاحنامه وتوصیفگرهای پزشکی فارسی» و «هستیشناسی بیماریها» و «هستیشناسی BAO» نشان داد که میانگین دقت مفاهیم و میانگین دقت مکانی مفاهیم بیش از 70 درصد با هستیشناسیهای بازنمایی شده در پایگاههای معتبر هستیشناسی بیماریهای انسانی «Bio-Ontologies» انطباق داشته و به طور میانگین بیش از 30 درصد واژگان جدید برای افزودن به دامنه را فراهم کرده است.
تمجید، سمیه، فاطمه نوشینفرد، ملوکالسادات حسینی بهشتی، نجلا حریری، و فهیمه بابالحوائجی. 1402. امکانسنجی توسعه هستیشناسی به روش نیمهخودکار مبتنی بر تحلیل بسامد واژگان: مطالعه موردی بیماری "گلوکوم". پژوهشنامه پردازش و مدیریت اطلاعات 39(1): 131-156.
