امکان سنجی توسعه هستی شناسی به روش نیمه خودکار مبتنی بر تحلیل بسامد واژگان: مطالعه موردی بیماری «گلوکوم»
نویسندگان
1 دانشگاه آزاد اسلامی؛ واحد علوم تحقیقات؛ تهران، ایران
2 دانشگاه آزاد اسلامی؛ واحد علوم تحقیقات؛ تهران، ایران
3 دانشگاه آزاد اسلامی؛ واحد علوم تحقیقات؛ تهران، ایران
4 پژوهشگاه علوم و فناوری اطلاعات ایران (ایرانداک)؛ تهران، ایران
5 دانشگاه آزاد اسلامی؛ واحد علوم تحقیقات؛ تهران، ایران
doi
10.22034/jipm.2023.698596چکیده
تغییر رویکرد نظامهای اطلاعاتی از پردازش واژه به پردازش مفهوم، موجب توجه به هستیشناسیها شده است. در علوم پزشکی و بیماریهای انسان به لحاظ وجود تنوع در اصطلاحات و لزوم اشتراک اطلاعات از طریق نرمافزارهای مختلف مانند پروندههای پزشکی، سامانههای ثبت سوابق بهداشتی و ... بهکارگیری هستیشناسیها ضروری به نظر میرسد. در پژوهش حاضر، رویکردی نیمهخودکار برای توسعه هستیشناسی پیشنهاد شده است که میتواند با استفاده از ابزارهای متنکاوی، شناسایی مؤلفههای ساختاری هستیشناسی و تعیین نسبی روابط را از متون علمی تسهیل کند. مدل پیشنهادی در قالب کد نرمافزاری با نام اختصاری TmbOnt_Alfa ارائه شده است. این کد با استفاده از رابط کاربر، فایل متنی ورودی را فراخوانی کرده و پس از پردازش بر اساس تنظیمات، اصطلاحات کلیدی برای توسعة هستیشناسی را استخراج میکند. بهمنظور ارزیابی کارایی روش پیشنهادی، مطالعه موردی در حوزة بیماری «گلوکوم» با دادههای متنی مشتمل بر10،000 چکیده مقاله از «پابمد» بر مبنای جستوجوی واژگانی تهیه گردید. پس از مراحل پردازش، مفاهیم و ساختار سلسلهمراتبی هستیشناسی حاصل در نرمافزار «پروتژ» وارد شد. سرانجام، سنجش قیاسی هستیشناسی توسعهیافته با سرعنوانهای موضوعی پزشکی «مش»، «اصطلاحنامه وتوصیفگرهای پزشکی فارسی» و «هستیشناسی بیماریها» و «هستیشناسی زیستپزشکی» نشان داد که میانگین دقت مفاهیم و میانگین دقت مکانی مفاهیم بیش از 70 درصد با هستیشناسیهای بازنماییشده در پایگاههای معتبر هستیشناسی بیماریهای انسانی انطباق داشته و بهطور میانگین بیش از 30 درصد واژگان جدید برای افزودن به دامنه را فراهم کرده است.