تشخیص خودکار متون تولید شده توسط ماشین مبتنی بر مدل‌های زبانی و یادگیری عمیق

نویسندگان

1 استادیار دانشگاه جامع امام حسین(ع)

2 دانشجوی کارشناسی ارشد دانشگاه جامع امام حسین(ع)

3 پژوهشگر دانشگاه جامع امام حسین(ع)

doi
10.22034/abmir.2025.22455.1078
چکیده

امروزه با رشد چشمگیر هوش مصنوعی و تولیدات آن، فرصت‌ها و تهدیدات زیادی به وجود آمده است. یکی از معروف‌ترین و محبوب‌ترین تولیدات هوش ‌مصنوعی تولید متن است که به آن متن ماشینی نیز گفته می‌شود. در این پژوهش روش جدیدی معرفی می‌شود که ویژگی‌های استخراج شده از متن را با ویژگی‌های ساختاری آن ترکیب کرده و به این ترتیب برای تشخیص متن نوشته شده توسط انسان و متن تولیدی هوش‌مصنوعی، یک متمایزگر خودکار ایجاد می‌کند. روش معرفی شده متشکل از دو بخش می‌باشد، بخش اول: مدل توسعه یافته‌ی (RoBERTa) BERT و مدل حافظه‌‌ای کوتاه مدت بلند مدت دو سویه (BiLSTM) است که با لایه‌ی ادغام بهبود یافته‌اند. بخش دوم: ویژگی‌های ساختاری متن با روشی مبتنی بر سبک نوشتار استخراج می‌شود. در نهایت خروجی بخش‌های مدل باهم ترکیب شده و به این ترتیب مدل متن نوشته شده توسط انسان را از متن تولید شده توسط ماشین تشخیص می‌دهد. نتایج حاصل از این پژوهش نشان می‌دهد که روش پیشنهادی با دقت 90 درصدی قابلیت تشخیص متون ماشینی را داشته و عملکرد مطلوبی را از خود به نمایش می‌گذارد.