بررسی میزان مطابقت بازیابی محتوا با تصویرها و چالشهای آن در مقالههای پایگاههای اطلاعاتی علمی
نویسندگان
1 پژوهشگاه علوم و فناوری اطلاعات ایران (ایرانداک)
2 دانشگاه شهید باهنر کرمان
3 دانشگاه شهید باهنر کرمان
doi
10.35050/JIPM010.2019.006چکیده
هدف از این تحقیق بررسی میزان مطابقت بازیابی محتوا با تصویرها و چالشهای آن در مقالههای پایگاههای اطلاعاتی علمی است. روش پیمایشی توصیفی بوده و جامعه آماری آن پایگاههای اطلاعاتی علمی «ساینس دایرکت»، «اسکوپوس»، «مدلاین» و «وب آو ساینس» است. ابتدا عنوان، چکیده، بیان مسئله و نتیجهگیری مقالهها بهصورت جداگانه وارد نرمافزار Extreme Picture Finderشد. سپس، تصویرهای مرتبط با عنوان، چکیده، بیان مسئله و نتیجهگیری مقالهها از نرمافزار مورد نظر استخراج گردید. تصویرهای استخراجشده وارد نرمافزار Visual Similarity Duplicate Image Finder گردید تا مطابقت تصویرهای استخراجشده از نرمافزار و تصویرهای مقالهها انجام شود. نتایج نشان داد که بیشترین میزان مطابقت محتوا با تصویر در پایگاه «وبآوساینس» و کمترین میزان مطابقت در پایگاه «ساینس دایرکت» وجود داشت. همچنین بهترتیب، بیشترین شباهت بین عنوانها، بیان مسئله، چکیده و نتیجهگیری با تصویرهای مقالهها در پایگاهها وجود داشت. عدم رعایت استانداردهای مصورسازی در تصویرهای بهکاررفته در مقالههای پایگاههای علمی چالشی جدی است. تصاویری که از استاندارهای مصورسازی (متن، رنگ، لبه، حاشیه و ...) به دور بودند، بازیابی نشدند و در صورت بازیابی از میزان شباهت نازلی برخوردار بودند. عدم جامعیت قابلیتهای نرمافزارهای مورد استفاده، چالش بعدی بود. مسئله دیگر عدم رعایت یا پیروی از یک شیوهنامه استاندارد در چیدمان تصویرها در مقالههاست. برخی تصویرها بدون توجه به متن در مقالهها درج شدهاند. این مورد در پایگاه «وبآوساینس» کمتر، اما در سایر پایگاههای مورد بررسی بسیار مشاهده گردید. با توجه به ابداع روشهای جدید بازیابی تصویر و محتوا، نتیجه این بررسی نشان میدهد که عدم شباهت بین تصویرهای بازیابیشده با محتوا در مقالات پایگاههای معتبر علمی چشمگیر و گمراهکننده است.