روشی جدید در تشخیص تکراری رکوردها با استفاده از خوشه‌‌بندی سلسله مراتبی

نویسندگان

1 دانشگاه تربیت دبیر شهید رجایی

2 دانشگاه آزاد اسلامی واحد علوم تحقیقات

doi
10.52547/jsdp.18.4.3
چکیده

به‌دلیل اهمیت بالای کیفیت داده‌‌ها در عملکرد سامانه‌های نرم‌‌افزاری، فرآیند پاکسازی داده به‌خصوص تشخیص رکوردهای تکراری، طی سالیان اخیر یکی از مهم‌‌ترین حوزه‌‌های علوم رایانه به حساب آمده است. در این مقاله روشی برای تشخیص رکوردهای تکراری ارائه شده است که با خوشه‌‌بندی سلسله‌‌مراتبی رکوردها بر اساس ویژگی‌‌های مناسب در ...