ارائه شبکه پیچیده بدون مقیاس با الگوی ترکیب لایهای زبان فارسی
نویسندگان
1 دانشجوی دکتری، گروه کامپیوتر و فناوری اطلاعات، دانشکده فنی و مهندسی، دانشگاه قم، قم، ایران.
2 استادیار، گروه مهندسی کامپیوتر و فناوری اطلاعات، دانشکده فنی و مهندسی، دانشگاه قم، قم، ایران
3 دانشجوی دکتری، گروه کامپیوتر و فناوری اطلاعات، دانشکده فنی و مهندسی، دانشگاه قم، قم، ایران.
doi
10.22091/stim.2022.8590.1858چکیده
هدف: پژوهش حاضر روشی را برای بررسی الگوهای ترکیب و ساختار توپولوژیکی زبان فارسی پیشنهاد کرده، و روش بهبودیافته متن فارسی را در قالب گراف شبکه همزمان در چارچوب نظریه شبکه پیچیده بررسی میکند. روش: یک مدل تهی با اندازه مشابه، با توجه به گراف تصادفی اردوش- رینی، برای مقایسه با شبکه فارسی تولید میشود. مقایسه براساس طول مسیر متوسط، ضریب خوشهبندی و سلسله مراتب هر دو شبکه است. از تجزیه و تحلیل این ویژگیهای کلیدی، مشاهده میشود که گراف شبکه فارسی با شبکه تصادفی متفاوت است. طول مسیر متوسط کوچکتر و ضریب خوشهبندی بالا نیز تأثیر مدل جهانی کوچک را در زبان فارسی تأیید میکند. یافتهها: برای اولین بار، متن فارسی با موفقیت به شبکه پیچیده تبدیل شد. یک مجموعه باز و بدون حاشیه بیش از دو میلیون کلمه، با استفاده از رویکرد جنگل تصادفی ساخته شده است. نتیجهگیری: شبکه حاصل طراحی شده، با مدل کیسه بایگرام شامل 3256 گره و 79705 لبه میباشد. علاوهبر این، برخلاف شبکه تصادفی که تنها یک جامعه وجود دارد، 12 اجتماع در شبکه فارسی شناسایی شده است. واقعیتهای آماری نشان میدهد که شبکه فارسی یک شبکه بدون مقیاس با الگوی ترکیب لایهای است.