امکان سنجی توسعه هستی شناسی به روش نیمه خودکار مبتنی بر تحلیل بسامد واژگان: مطالعه موردی بیماری «گلوکوم»

نویسندگان

1 دانشگاه آزاد اسلامی؛ واحد علوم تحقیقات؛ تهران، ایران

2 دانشگاه آزاد اسلامی؛ واحد علوم تحقیقات؛ تهران، ایران

3 دانشگاه آزاد اسلامی؛ واحد علوم تحقیقات؛ تهران، ایران

4 پژوهشگاه علوم و فناوری اطلاعات ایران (ایرانداک)؛ تهران، ایران

5 دانشگاه آزاد اسلامی؛ واحد علوم تحقیقات؛ تهران، ایران

doi
10.22034/jipm.2023.698596
چکیده

 تغییر رویکرد نظام‌های اطلاعاتی از پردازش واژه به پردازش مفهوم، موجب توجه به هستی‌شناسی‌ها شده است. در علوم پزشکی و بیماری‌های انسان به ‌لحاظ وجود تنوع در اصطلاحات و لزوم اشتراک اطلاعات از طریق نرم‌افزارهای مختلف مانند پرونده‌های پزشکی، سامانه‌های ثبت سوابق بهداشتی و ... ‌به‌کارگیری هستی‌شناسی‌ها ضروری به ‌نظر می‌رسد. در ‌پژوهش حاضر، رویکردی نیمه‌خودکار برای توسعه هستی‌شناسی پیشنهاد شده است که می‌تواند با استفاده از ابزارهای متن‌کاوی، شناسایی مؤلفه‌های ساختاری هستی‌شناسی و تعیین نسبی روابط را از متون علمی تسهیل کند. مدل پیشنهادی در قالب کد نرم‌افزاری با نام اختصاری TmbOnt_Alfa ارائه شده است. این کد با استفاده از رابط کاربر، فایل متنی ورودی را فراخوانی کرده و پس از پردازش بر اساس تنظیمات، اصطلاحات کلیدی برای توسعة هستی‌شناسی را استخراج می‌کند. به‌منظور ارزیابی کارایی روش پیشنهادی، مطالعه موردی در حوزة بیماری «گلوکوم» با داده‌های متنی مشتمل بر10،000 چکیده مقاله از «پابمد» بر مبنای جست‌وجوی واژگانی تهیه گردید. پس از مراحل پردازش، مفاهیم و ساختار سلسله‌مراتبی هستی‌شناسی حاصل در نرم‌افزار «پروتژ» وارد شد. سرانجام، سنجش قیاسی هستی‌شناسی توسعه‌یافته با سرعنوان‌های موضوعی پزشکی «مش»، «اصطلاحنامه وتوصیفگرهای پزشکی فارسی» و «هستی‌شناسی بیماری‌ها» و «هستی‌شناسی زیست‌پزشکی» نشان داد که میانگین دقت مفاهیم و میانگین دقت مکانی مفاهیم بیش از 70 درصد با هستی‌شناسی‌های بازنمایی‌شده در پایگاه‌های معتبر هستی‌شناسی بیماری‌های انسانی انطباق داشته و به‌طور میانگین بیش از 30 درصد واژگان جدید برای افزودن به دامنه را فراهم کرده است.