بهینه ساز مرتبه کسری آدام با رویکرد فرایادگیری مبتنی بر یادگیری تقویتی
محل انتشار: ششمین کنفرانس بین المللی محاسبات نرم
سال انتشار: 1404
نوع سند: مقاله کنفرانسی
زبان: فارسی
مشاهده: 8
فایل این مقاله در 9 صفحه با فرمت PDF قابل دریافت می باشد
- صدور گواهی نمایه سازی
- من نویسنده این مقاله هستم
استخراج به نرم افزارهای پژوهشی:
شناسه ملی سند علمی:
CSCG06_112
تاریخ نمایه سازی: 4 مهر 1405
چکیده مقاله:
در این پژوهش بهینه ساز مبتنی بر حسابان مرتبه کسری روی توابع هدف تصادفی ارائه شده که بر اساس برآوردهای تطبیقی از ممان های مرتبه پایین بنا شده است که عامل یادگیری تقویتی با بهینه ساز مرتبه کسری آدام سیاست گذاری قطعی عمیق و شبکه سیاست مبتنی بر مکانیزم توجه مرتبه ممان های کسری را به صورت یادگیری تقویتی فرایادگیری، پویا تنظیم می کند. این روش نسبت به تغییر مقیاس مستقل هر مولفه گرادیان تغییرناپذیر است و برای توابع هدف ناپایا، مسائلی با گرادیان های نویزی و یا پراکنده و در کاربردهایی که سرعت یادگیری بر اندازه حافظه اشغال شده اولویت دارند مناسب است. نتایج نشان دهنده سرعت بالاتر یادگیری و مقاومت بیشتر در برابر نویز نسبت به سایر روش های بهینه سازی، آدام، آداگارد و SGD با مومنتوم می باشد.
کلیدواژه ها:
نویسندگان
حسین ضحاکی منصور
دانشجوی کارشناسی ارشد دانشگاه صنعتی همدان
هادی دلاوری
دانشیار دانشگاه صنعتی همدان