بهبود روش MFCC برای تشخیص گوینده در عملیات جاسوسی

نویسندگان

1 دانش‌آموخته کارشناسی ارشد دانشکده برق دانشگاه علم و صنعت ایران

2 استادیار و عضو هیئت علمی دانشگاه جامع امام حسین(ع)

doi
چکیده

در این مقاله، روشی جدید برای استخراج ویژگی از سیگنال صوت و تشخیص گوینده صدا ارائه شده است که کاربرد وسیعی در علوم جاسوسی و پدافند غیرعامل دارد (بدین صورت که با تشخیص گوینده یک صدای ضبط‌شده می­توان اولا مانع تقلید صدای افراد خاص مانند فرماندهان شد و ثانیاً می­توان در استراق سمع مکانی که چندین نفر در حال گفتگوی مهمی هستند، گوینده هر صدا را تشخیص داد). در واقع روش ارائه‌شده، بهبودیافته روش MFCC می­باشد. از آن­جایی که با توجه به آزمایشات، بیشتر اطلاعات صوت در فرکانس‌های پایین آن ذخیره می­شود و فرکانس­های بالای آن اطلاعات تفکیک‌کننده زیادی ندارد، محققان معمولاً ویژگی­های صوت را از فرکانس­های پایین سیگنال صوت استخراج می­کنند. در روش ارائه‌شده در این مقاله، فیلتر فرکانسی Mel که در روش MFCC استفاده می­شود، تغییر و بهبود داده شده و در انتها نتایج روش ارائه‌شده (MMFCC) با روش MFCC مقایسه شده و بهبود آن اثبات شده است. نتایج حاصله برای 20 گوینده متفاوت مؤید این است که برای روش بهبودیافته خطی درصد تشخیص گوینده حدود 5/4٪ و برای روش بهبودیافته نهائی حدود 9٪ ارتقاء یافته است.