روش شناسی پیوند داده بر اساس الگوریتم احتمالاتی: یک مقاله مروری
نویسندگان
1 تحلیلگر سیستمهای کامپیوتری، مرکز تحقیقات سرطان دانشگاه علوم پزشکی تهران
2 دانشیار اپیدمیولوژی، گروه پزشکی اجتماعی، دانشکده پزشکی، دانشگاه علوم پزشکی شهید بهشتی
3 دانشجوی دکترای تخصصی اپیدمیولوژی، دانشکده پزشکی، دانشگاه علوم پزشکی زابل، زابل، ایران دانشجوی دکترای تخصصی اپیدمیولوژی، گروه اپیدمیولوژی، دانشکده بهداشت، دانشگاه علوم پزشکی تهران، تهران، ایران
4 دانشجوی دکترای تخصصی اپیدمیولوژی، دانشکده پزشکی، دانشگاه علوم پزشکی کردستان،سنندج، ایران دانشجوی دکترای تخصصی اپیدمیولوژی، گروه اپیدمیولوژی، دانشکده بهداشت، دانشگاه علوم پزشکی ایران، تهران، ایران
5 دکتری تخصصی پژوهش، پژوهشکده علوم غدد درون ریز و متابولیسم، دانشگاه علوم پزشکی شهید بهشتی
doi
چکیده
امروزه با پیشرفت تکنولوژی و توسعه پژوهش در کشور، شاهد شکل گرفتن بانک های اطلاعاتی بزرگ و ارزشمند هستیم. لازمه ردیابی اطلاعاتافراد در این مجموعه های گرانبها، بکارگیری روشهای جدید واکاوی داده های مرتبط میباشد. با این روشها اطلاعات بسیار مفیدی را میتوان درباره تشخیص، سبب شناختی و پیش آگهی پیامدهای مختلف بدون انجام مطالعات پرهزینه فراهم کرد. گوناگونی در جمعآوری و تعاریف فیلد های حاوی داده های سلامت در بانکهای اطلاعاتی مختلف، نیاز به آشنایی با روش شناسی پیوند داده ها را بیشتر میکند. هدف از این مقاله مروری، آشنایی با روششناسی پیوند داده ها براساس روشهای احتمالاتی میباشد. تعریف پیوند داده در دو روش قطعی و احتمالاتی ارائه خواهد شود و در ادامه مبانی روش شناختی پیوند داده احتمالاتی مانند ارزیابی کیفیت داده ها، ارزیابی همسان بودن رکوردها و محاسبه وزن همسان بودن رکوردها از دو بانک اطلاعاتی به همراه تعیین سطح تصمیم گیری برای همسان بودن آنها بحث خواهد شد. در قالب یک مثال عملی روششناسی پیوند داده احتمالاتی با استفاده از داده های بانک اطلاعات ثبت سرطان و مرگ و میر نشان خواهد داده شد.