نظام آوایی زبان فارسی در آینة آمار
نویسندگان
1 دانشگاه زنجان
2 دانشجوی دکتری رشتة علوم کامپیوتر، دانشگاه ملبورن
3 دانشجوی کارشناسی ارشد زبانشناسی، دانشگاه الزهرا
doi
چکیده
در پژوهش حاضر، با تحلیل آماریِ ویژگیهای واجیِ موجود در 54391 واژة فارسی، کوشیدهایم تا جنبههایی از سازوکار نظام آوایی زبان فارسی را با زبان آمار بیان کنیم. جنبههای واجی-آماریِ موجود در واژگان (ذهنی) فارسیزبانها، که در این تحقیق به آن پرداختهایم، مواردی مانند الگوی تکیة واژه در زبان فارسی، هجا و تعداد هجا در واژة فارسی، واجآراییِ واژههای فارسی، بسامد طبقات طبیعی واجی در کل دادهها، بسامد طبقات طبیعی واجی در درون هجا، واجآراییِ خوشههای همخوانی، هجای بینشان و بهینه در زبان، فراوانی واجها در زبان فارسی و مسائل مشابه را دربرمیگیرد. در انتخاب واژهها، ابتدا یک پیکرة متنی ده میلیون کلمهای مورد تجزیة ساختواژی قرار گرفت و در ادامه با حذف صورتکلمهها و نیز کلمات خارجی فهرست واژهها به دست آمد و سپس این فهرست با فرهنگ معاصر فارسی امروز مقابله شد و مدخلهای جدید با بسامد 1 به فهرست واژگان اضافه شد و سپس کل واژهها از نظر اطلاعات واجی فوق مورد تجزیه و تحلیل قرار گرفت. نتایج این تحقیق واجی-آماری از یک سو مؤید اصول و مفاهیم واجشناختی مانند طبقة طبیعی واجی، فرایندهای واجی، ساختمان سلسلهمراتبیِ هجا و غیره است و از طرف دیگر بسامد واجها و زنجیرههای واجی را بازگو میکند، که در نتیجة آن پیوستار بینشانی و نشانداری در نظام آوایی زبان مشخص میشود.