تحلیل پیکره بنیان متون فارسی میانه بر مبنای پایگاه داده پارسیگ
نویسندگان
1 دانشیار زبانهای باستانی، پژوهشگاه علوم انسانی و مطالعات فرهنگی(نویسنده مسئول)
2 استادیار زبانشناسی،پژوهشگاه علوم انسانی و مطالعات فرهنگی
3 کارشناس پژوهشی گروه فرهنگ و زبانهای باستانی، پژوهشکده زبانشناسی، پژوهشگاه علوم انسانی و مطالعات فرهنگی
doi
10.30465/ls.2021.6590چکیده
رویکرد نوین در مطالعات زبانشناختی یا یک پدیده زبانی بر اصل وجود مجموعهای از دادههای زبانی گردآوریشده نهادینه شدهاست؛ بنابراین به تهیه یک پیکره زبانی نیاز است که از تولیدات واقعی گویشوران و نه براساس شمّ زبانیِ فردی گردآوری شدهاست. این شیوۀ پژوهشی برای بررسی دادههای زبانی تاریخی که جزء زبانهای مرده است و اکنون هیچگونه گویشوری ندارد از اهمیت بهسزایی برخوردار است. هدف از انجام این پژوهش، تهیه پیکرۀ زبان پهلوی ساسانی (فارسی میانه) و ساماندهی آن در یک پایگاه است. برای هر واژه، شش لایۀ اطلاعاتی، اعم از حرفنویسی متن پهلوی، آوانویسی واژهها بههمراه ترجمۀ فارسی آنها، تعیین مقولۀ دستوری دانهریز واژهها، بنواژهسازی واژهها و تعیین هزوارشبودن آنها، تعریف شدهاست. برای مقولۀ دستوری دانهریز واژهها، مجموعۀ برچسب مقولات دستوری فارسی معاصر تهیهشده توسط بیجنخان و همکاران (2011) و ساختارمندشده توسط قیومی (2014) باتوجهبه نیازهای زبان پهلوی جرح و تعدیل شدهاست و از مجموعۀ جدید برای برچسبگذاری واژههای پهلوی استفاده شدهاست. پس از نشانهگذاری واژهها و ساماندهی اطلاعات، امکان استخراج اطلاعات آماری وجود دارد که میتواند بینش عمیقتری از محتوای متن منتقل نماید. ازاینرو، اطلاعات آماری از پیکرۀ بهدستآمده استخراج شده و توضیح داده میشود تا دورنمای کلی نسبتبه منابع تشکیلدهندۀ این پیکره بهدستآید.