تحلیل پوششی داده‌ها با داده‌های گمشده

نویسندگان

1 دانشجوی دکتری، گروه ریاضی، واحد پارس آباد مغان، دانشگاه آزاد اسلامی، پارس آباد مغان، ایران

2 استادیار، گروه ریاضی، واحد پارس‌آباد مغان، دانشگاه آزاد اسلامی، پارس‌آباد مغان، ایران

3 کارشناسی ارشد، گروه ریاضی، واحد پارس‌آباد مغان، دانشگاه آزاد اسلامی، پارس‌آباد مغان، ایران

doi
چکیده

داده‌های گمشده در کاربردهای تحلیل پوششی داده‌ها یک بیماری مزمن محسوب می‌شوند. خیلی از ‏اوقات، متغیرهای مهم ورودی یا خروجی پوشش ناکامل دارند و یا اینکه واحدهای تصمیم‌گیری همه‌ی ‏آمارهای لازم را گزارش نمی‌کنند. بنابراین، مقادیر گمشده در ورودی‌ها و خروجی‌ها را نمی‌توان با ‏مدل‌های اصلی تحلیل پوششی داده‌ها مورد بررسی قرار داد. در این مقاله، روش‌هایی را برای پیدا کردن ‏داده‌های گمشده در حالتی که داده‌ها قطعی هستند، ارائه می‌کنیم. در این مقاله پس از تشریح مفاهیم ‏ضروری داده‌های گمشده، برخی از روش‌های جانهی داده‌های گمشده که موجب کاهش پیچیدگی تحلیل ‏داده‌ها می‌شود تشریح می‌شود. روش‌های مختلفی برای جانهی داده‌های بی‌پاسخ موجود است از جمله ‏روش‌های گوناگون جانهی ساده و جانهی چندگانه. این مقاله نخستین کوشش سیستماتیک برای ‏بهره‌مندی از داده‌های حاوی مقادیر گمشده با بهره‌مندی از رویکردهای آماری در ‏DEA‏ است. به طور ‏خاص، بررسی می‌کنیم که اگر درایه‌های خالی را در مجموعه‌ی داده‌ها نگه داریم و یک مقدار عددی خاص ‏به آن‌ها اختصاص دهیم، چه اتفاقی می‌افتد. برای نشان دادن طرز کار روش‌های پیشنهادی، از این روش‌ها ‏برای ارزیابی مجموعه‌ای از مدارس متوسطه‌ی دولتی یونان که برخی دارای مقادیر گمشده در ورودی ‏یا خروجی هستند، بهره‌مندی خواهد شد.‏