تشخیص خودکار هویت نویسندۀ متن در زبان فارسی براساس دستور نقشگرای نظاممند
نویسندگان
1 دکتری زبانشناسی، گروه زبانشناسی، دانشکده ادبیات فارسی و زبانهای خارجه، دانشگاه علامه طباطبایی، تهران، ایران
2 استادیار گروه رایانه، دانشکده آمار، ریاضی و رایانه، دانشگاه علامه طباطبایی، تهران، ایران
3 استادیار گروه آموزش مترجمی زبان انگلیسی، واحد کرج، دانشگاه آزاد اسلامی، کرج، ایران.
4 دانشیار گروه زبانشناسی، دانشکده ادبیات فارسی و زبانهای خارجه، دانشگاه علامه طباطبایی، تهران، ایران
doi
10.22126/jlw.2023.9391.1716چکیده
تشخیص خودکار هویت نویسندۀ متن یکی از مسائل مهم زبانشناسی حقوقی تلقی میشود. در پژوهش حاضر تلاش میشود کارایی ویژگیهای مبتنیبر مفاهیم دستور نقشگرای نظاممند هالیدی (هالیدی و متیسن، 2014) با کارایی واژههای دستوری در تشخیص هویت نویسنده مقایسه شود. به این منظور، در ابتدا، پیکرهای از آثار هفت نویسندۀ معاصر ایرانی گردآوری شد. در مرحلۀ دوم، از واژههای دستوری استخراجشده از پیکره فهرستی تهیه شد؛ بهعلاوه، یک مجموعة واژگان براساس شبکۀ نظام حروف ربط، شبکۀ نظام افزودۀ وجه و شبکۀ نظام افزودۀ نگرشی با استفاده از منابع زبانی تهیه شد. سپس بسامد نسبی واژههای دستوری و ویژگیهای مبتنیبر دستور نقشگرای نظاممند در هر متن محاسبه شد. طبقهبند پرسپترون چند لایه، نوعی شبکة عصبی، برای مرحلۀ آموزش سامانه به کار گرفته شد و به دقت مطلوبی در مرحلۀ ارزیابی منجر شد. بررسی نتایج ارزیابی سامانه نشان داد که روش محاسبۀ بسامد واژههای دستوری نسبتبه روش مبتنیبر دستور نقشگرای نظاممند در تشخیص هویت نویسندۀ متون فارسی برتری دارد؛ باوجوداین، هنگامی که ویژگیهای دستور نقشگرای نظاممند هالیدی درکنار ویژگی بسامد واژههای دستوری به کار روند، کارایی سامانه نسبتبه حالتی که تنها از ویژگی بسامد واژههای دستوری استفاده شود، ارتقا مییابد.