تعیین تعداد گروه در مجموعه داده های ژئوشیمیایی با استفاده از شاخص های بازشناسی الگوی مبتنی بر تفکیک و تراکم خوشه ها

نویسندگان

1 دانشکده مهندسی معدن دانشگاه صنعتی اصفهان

2 دانشکده مهندسی معدن، دانشگاه صنعتی اصفهان

3 دانشکده مهندسی معدن، دانشگاه صنعتی اصفهان

doi
10.22034/anm.2019.1363
چکیده

تقسیم‌بندی مجموعه داده به زیرمجموعه‌های همگن، هدفی اساسی در تحلیل داده‌های ژئوشیمیایی است که اغلب از ابزار خوشه‌بندی برای نیل به آن استفاده می‌شود. مهم‌ترین چالش عملی موجود در این راستا، تخمین تعداد حقیقی گروه‌های نهان در مجموعه داده است که به طور سنتی از اطلاعات ژئوشیمیایی توصیفی، دانش کارشناسی یا به کارگیری یک شاخص آماری خاص برای حل آن استفاده می‌شود. خروجی این روش‌ها اغلب ناپایدار و همراه با عدم‌قطعیت است، لذا رویکردی که این مقاله برای حل مسئله تعیین تعداد خوشه در داده‌ها پیشنهاد می‌کند، اجرای گستره‌ای از شاخص­‌های موجود و تولید توزیعی از پاسخ‌های ممکن و نهایتاً استخراج جواب نهایی از آن است. شاخص‌های به کار رفته در این زمینه، مبتنی بر روابط بازشناسی الگو و بر مبنای بیشینه‌سازی پارامتر تفکیک بین گروهی و کمینه‌سازی پارامتر تراکم درون گروهی هستند. جهت آزمون رویکرد پیشنهادی، مجموعه داده شبیه‌سازی شده دوبعدی با چهار خوشه مصنوعی تولید گشته و با اجرای 30 شاخص پرکاربرد بر روی آن، بالاترین فرکانس موجود در توزیع پاسخ‌ها منطبق بر جواب حقیقی مسئله به دست آمده است. این راهکار عیناً بر روی یک مجموعه داده ژئوشیمیایی حقیقی و چندمتغیره، شامل داده‌های خاک کانسار مس- طلای دالی شمالی واقع در استان مرکزی اجرا شده است که نتایج به دست آمده نشان دهنده معنی‌دار بودن و انطباق پاسخ نهایی با فرآیندهای زمین‌شناسی و کانه‌زایی محدوده است.