یادگیری دوگان ژرف و کاربردهای آن

نویسندگان

1 دانش آموخته کارشناسی ارشد، مهندسی کامپیوتر، دانشکده مهندسی کامپیوتر، دانشگاه صنعتی شریف، تهران، ایران

2 دانشیار، مهندسی کامپیوتر، دانشکده مهندسی کامپیوتر، دانشگاه صنعتی شریف، تهران، ایران

doi
چکیده

یادگیری ژرف، که در بسیاری از مسائل هوش مصنوعی به نتایج بسیار خوبی رسیده است، از این واقعیت رنج می‌برد که عملکرد آن به‌شدت به حجم داده‌های برچسب‌دار بستگی دارد. در بسیاری از کاربردهای دنیای واقعی، تعداد نمونه‌های دارای برچسب معمولاً محدود بوده و گردآوری آن نیز پرهزینه است. درحالی‌که اغلب، نمونه‌های بدون برچسب به مقدار کافی موجود است. بنابراین، ارائه‌ی روش‌هایی برای بهره‌برداری مؤثر از نمونه‌های بدون برچسب توجه بسیاری را به خود جلب کرده‌ است. گذشته از این، بسیاری از مسائل هوش مصنوعی در قالب دوگان ظاهر می‌شوند؛ برای نمونه، ترجمه انگلیسی به فارسی در مقابل ترجمه فارسی به انگلیسی و طبقه‌بندی تصویر در مقابل تولید تصویر. در سال‌های اخیر، روش‌های متعددی برای استفاده از همبستگی بین وظایف دوگان ارائه شده است. در این مقاله، به بررسی روش‌های یادگیری دوگان می‌پردازیم، که هدف از آن بهره‌برداری مؤثر از دوگانگی میان دو وظیفه‌ی دوگان در آموزش و یا استنتاج است. یادگیری دوگان را می‌توان به سه سطح مختلف، یعنی دوگانگی در سطح داده‌، در سطح مدل و در سطح استنتاج تقسیم نمود‌. در این مقاله، به روش‌های مختلف برای بهره‌گیری از این ایده‌ها و موفقیت‌های آن‌ها در کاربردهای مختلف، خواهیم پرداخت. همچنین نشان خواهیم داد که چگونه یادگیری دوگان به‌طور مؤثر نیاز به داده‌های دارای برچسب را کاهش می‌دهد.