طراحی آماری یک روش نمونهبرداری در کنترل کیفیت دادههای پژوهشی
نویسندگان
1 دانشیار، پژوهشگاه علوم و فناوری اطلاعات ایران (ایرانداک)، تهران، ایران
doi
10.22034/aimj.2022.163827چکیده
در مدارک علمی، نمایهسازی و کنترل کیفیت، فرایندهایی کلیدی وجود دارد که در صورت انجام درست آنها، امکان بازیابی مناسب در موتورهای جستوجو فراهم میآید. در منابع علمی، به روشهای نمونهبرداری در محصولات فیزیکی به اندازۀ کافی پرداخته شده است؛ اما در حوزه دادهها، بهویژه دادههای پژوهشی، کارهای اندکی انجام شده است. در این پژوهش، چارچوبی برای نمونهبرداری فرایندهای کنترل کیفیت داده فراهم شده است. بهعنوان مطالعه موردی، دادههای پژوهشی پایگاه اشاعه اطلاعات پایاننامهها/ رساله (پارسا)های دانشآموختگان کل کشور (گنج) انتخاب شده است. بر اساس نتایج، با توجه به کیفیت پذیرفتنی بسیاری از اقلام اطلاعاتی پارسا، پس از ثبت، نمونهبرداری کاری حیاتی برای ارتقای کارایی واحد سازماندهی و تحلیل اطلاعات است. منحنی OC برای طرحهای گوناگون نشان میدهد که طرحهای ارائهشده برای ارزیابی سطح کیفیت دادههای پژوهشی، از کارایی مناسبی برخوردارند. چارچوب ارائهشده در این پژوهش، برای سازمانهای گوناگون دادهمحور، بهویژه کسبوکارهای مبتنی بر داده، قابلیت بومیسازی دارد.