طراحی مدل زبانی بزرگ برای زبان فارسی با استفاده از ساختار RAG و بازیابی چندلایه
سال انتشار: 1405
نوع سند: مقاله کنفرانسی
زبان: فارسی
مشاهده: 86
فایل این مقاله در 9 صفحه با فرمت PDF قابل دریافت می باشد
- صدور گواهی نمایه سازی
- من نویسنده این مقاله هستم
استخراج به نرم افزارهای پژوهشی:
شناسه ملی سند علمی:
DMECONF11_066
تاریخ نمایه سازی: 26 شهریور 1405
چکیده مقاله:
در این پژوهش سامانه ای هوشمند برای پاسخگویی به پرسش های کاربران از روی اسناد متنی، فارسی به ویژه فایل های PDF طراحی و پیاده سازی شده است، هدف افزایش دقت و سرعت استخراج اطلاعات از متون غیر ساخت یافته با بهره گیری از معماری RAG و بازیابی ترکیبی است. در روش پیشنهادی نتایج بازیاب معنایی مبتنی بر مدل LaMA۳.۱ و بازیاب واژگانی BM۲۵ ادغام شده و مرتبط ترین بخش های متن به مدل زبانی ارسال می شود. پیاده سازی با کتابخانه های پایتونی انجام شده و ارزیابی ها نشان می دهد این ترکیب دقت پاسخگویی را به ویژه در متون تخصصی حتی با سخت افزار محدود، بهبود می بخشد.
کلیدواژه ها:
نویسندگان
فاطمه غفرانی
گروه مهندسی کامپیوتر دانشگاه ملی مهارت، تهران، ایران
تکتم ذوقی
استادیار، گروه مهندسی کامپیوتر دانشگاه ملی مهارت، تهران، ایران