رانندگی خودکار در محیط بزرگراه مبتنی بر یادگیری سیاست با استفاده از روش‌های یادگیری تقویتی توزیعی

نویسندگان

1 دانشکده مهندسی خودرو- دانشگاه علم و صنعت ایران

2 دانشکده مهندسی خودرو- دانشگاه علم و صنعت ایران

doi
10.52547/jiaeee.19.2.207
چکیده

این مقاله به ارائه یک روش یادگیری مبتنی بر یادگیری تقویتی جهت طراحی یک ناظر به منظور رانندگی خودکار در محیط بزرگراه می‌پردازد. با توجه به تصادفی بودن شرایط رانندگی در بزرگراه و همچنین درنظر گرفتن شرایط واقعی تر رانندگی، از مزایای یادگیری تقویتی توزیعی عمیق بهره گرفته شده است. در ...