طراحی مدل زبانی بزرگ برای زبان فارسی با استفاده از ساختار RAG و بازیابی چندلایه

سال انتشار: 1405
نوع سند: مقاله کنفرانسی
زبان: فارسی
مشاهده: 86

فایل این مقاله در 9 صفحه با فرمت PDF قابل دریافت می باشد

استخراج به نرم افزارهای پژوهشی:

لینک ثابت به این مقاله:

شناسه ملی سند علمی:

DMECONF11_066

تاریخ نمایه سازی: 26 شهریور 1405

چکیده مقاله:

در این پژوهش سامانه ای هوشمند برای پاسخگویی به پرسش های کاربران از روی اسناد متنی، فارسی به ویژه فایل های PDF طراحی و پیاده سازی شده است، هدف افزایش دقت و سرعت استخراج اطلاعات از متون غیر ساخت یافته با بهره گیری از معماری RAG و بازیابی ترکیبی است. در روش پیشنهادی نتایج بازیاب معنایی مبتنی بر مدل LaMA۳.۱ و بازیاب واژگانی BM۲۵ ادغام شده و مرتبط ترین بخش های متن به مدل زبانی ارسال می شود. پیاده سازی با کتابخانه های پایتونی انجام شده و ارزیابی ها نشان می دهد این ترکیب دقت پاسخگویی را به ویژه در متون تخصصی حتی با سخت افزار محدود، بهبود می بخشد.

کلیدواژه ها:

نویسندگان

فاطمه غفرانی

گروه مهندسی کامپیوتر دانشگاه ملی مهارت، تهران، ایران

تکتم ذوقی

استادیار، گروه مهندسی کامپیوتر دانشگاه ملی مهارت، تهران، ایران