تشخیص هوشمند و خودکار غلطهای تایپی در پایگاهدادههای بزرگ بدون استفاده از لغتنامه
نویسندگان
1 دانشگاه تبریز - دانشکده مهندسی برق و کامپیوتر - گروه مهندسی کامپیوتر
2 دانشگاه آزاد اسلامی واحد تبریز - گروه مهندسی کامپیوتر
3 دانشگاه آزاد اسلامی واحد خسروشاه - گروه مهندسی کامپیوتر
doi
چکیده
غلطهای تایپی یکی از مشکلات مهم در سیستمهای کامپیوتری و سیستمهای پایگاهدادهای است. وجود غلطهای تایپی در پایگاهدادهها نه تنها از نظر صحت پایگاهداده مشکلساز هستند، بلکه باعث میشوند به هنگام ضرورت نتوان رکورد واردشده را بازیابی کرد. همین امر گاه باعث میشود که کاربر مجدداً همان رکورد را وارد پایگاهداده نماید که منجر به وجود آمدن افزونگی میگردد. روشهای موجود تشخیص غلطها، مبتنی بر لغتنامه هستند. بدین معنی که از یک لغتنامه بزرگ که همه لغات آن صحیح فرض میشوند استفاده میکنند و اگر کلمهای در لغتنامه نباشد بهعنوان غلط تایپی شناخته میشود. تهیه لغتنامهای بزرگ و با دقت بالا بسیار پرهزینه و زمانبر است. بهعلاوه چنین لغتنامهای مختص یک زمینه خاص (مثلاً محیط پزشکی) است و قابلاستفاده و در زمینههای دیگر (مثلاً جامعهشناسی) نیست. در این مقاله روشی ارائه میشود که بدون نیاز به لغتنامه میتواند غلطهای تایپی را تشخیص دهد. روش پیشنهادی با چند معیار مرسوم ارزیابی شده است. نتایج آزمایشها نشاندهنده دقت 93.5 درصدی برای این روش است. علاوهبر دقت بالای روش پیشنهادی، عدمنیاز به لغتنامه یک ویژگی منحصر به فرد برای آن بهشمار میرود.