تحلیل پارامترهای آکوستیکی کیفیت صدا برای شناسایی گویندگان فارسیزبان
doi
10.22067/jlkd.2025.91521.1295چکیده
پژوهش حاضر به بررسی آکوستیکی پارامترهای کیفیت صدا در دو گروه زنان و مردان فارسیزبان میپردازد. این مطالعه با هدف ارزیابی توانایی پارامترهای کیفیت صدا در تمایز گویندگان فارسیزبان و بررسی میزان اثرگذاری این پارامترها در شناسایی ویژگیهای گویندهمحور طراحی شده است. علاوه بر این، با هدف گسترش دانش موجود در حوزۀ کیفیت صدا و پر کردن خلأ مطالعات محدود پیشین در زبان فارسی انجام شده است. دادههای آوایی از ۲۰ گویشور زن و ۲۰ گویشور مرد در محیط آزمایشگاهی ضبط شدند. برای تحلیل تفاوتهای میان گویندگان از آزمون تحلیل واریانس چندمتغیره و برای ارزیابی اهمیت ویژگیها، از الگوریتم جنگل تصادفی بهره گرفته شد. شش پارامتر کیفیت صدا شامل فرکانسپریشی، دامنهپریشی، نسبت هارمونیک به نویز، نسبت دامنۀ هارمونیکهای اول و دوم، برجستگی قلۀ طیفی و فرکانس پایه انتخاب شدند. نتایج نشان داد ویژگیهای کیفیت صدا در نشاندادن تفاوتهای آکوستیکی میان گویندگان فارسیزبان دارای تفاوتهای معناداری بودهاند، اگرچه توانایی آنها در تمایز گویندگان بهطور یکسان نبوده است. برای گویندگان مرد، پارامترهای برجستگی قلۀ طیفی، نسبت هارمونیک به نویز و نسبت دامنۀ هارمونیکهای اول و دوم، به ترتیب بیشترین توانایی را در تمایز آنها از یکدیگر دارند. برای گویندگان زن، فرکانس پایه، برجستگی قلۀ طیفی و نسبت هارمونیک به نویز بهعنوان مهمترین ویژگیها برای تشخیص هویت شناخته شدند. نتایج این پژوهش نشان میدهد پارامترهای کیفیت صدا نقش قابلتوجهی در شناسایی گویندگان فارسیزبان دارند. بااینحال، برای دستیابی به دقت بالاتر در سیستمهای شناسایی گوینده، توجه به تفاوتهای جنسیتی و اهمیت متغیرهای مختلف ضروری است. از طرف دیگر، محدودیت تعداد شرکتکنندگان ممکن است بر تعمیمپذیری نتایج تأثیر بگذارد؛ بنابراین، پیشنهاد میشود در پژوهشهای آینده، از نمونههای بزرگتر و تنوع بیشتر در گویندگان استفاده شود.