بهینه ساز مرتبه کسری آدام با رویکرد فرایادگیری مبتنی بر یادگیری تقویتی

سال انتشار: 1404
نوع سند: مقاله کنفرانسی
زبان: فارسی
مشاهده: 8

فایل این مقاله در 9 صفحه با فرمت PDF قابل دریافت می باشد

استخراج به نرم افزارهای پژوهشی:

لینک ثابت به این مقاله:

شناسه ملی سند علمی:

CSCG06_112

تاریخ نمایه سازی: 4 مهر 1405

چکیده مقاله:

در این پژوهش بهینه ساز مبتنی بر حسابان مرتبه کسری روی توابع هدف تصادفی ارائه شده که بر اساس برآوردهای تطبیقی از ممان های مرتبه پایین بنا شده است که عامل یادگیری تقویتی با بهینه ساز مرتبه کسری آدام سیاست گذاری قطعی عمیق و شبکه سیاست مبتنی بر مکانیزم توجه مرتبه ممان های کسری را به صورت یادگیری تقویتی فرایادگیری، پویا تنظیم می کند. این روش نسبت به تغییر مقیاس مستقل هر مولفه گرادیان تغییرناپذیر است و برای توابع هدف ناپایا، مسائلی با گرادیان های نویزی و یا پراکنده و در کاربردهایی که سرعت یادگیری بر اندازه حافظه اشغال شده اولویت دارند مناسب است. نتایج نشان دهنده سرعت بالاتر یادگیری و مقاومت بیشتر در برابر نویز نسبت به سایر روش های بهینه سازی، آدام، آداگارد و SGD با مومنتوم می باشد.

نویسندگان

حسین ضحاکی منصور

دانشجوی کارشناسی ارشد دانشگاه صنعتی همدان

هادی دلاوری

دانشیار دانشگاه صنعتی همدان