ارزیابی و بررسی استخراج اتوماتیک متن کاوی درمجموعه داده های بزرگ
سال انتشار: 1403
نوع سند: مقاله کنفرانسی
زبان: فارسی
مشاهده: 397
فایل این مقاله در 9 صفحه با فرمت PDF قابل دریافت می باشد
- صدور گواهی نمایه سازی
- من نویسنده این مقاله هستم
این مقاله در بخشهای موضوعی زیر دسته بندی شده است:
استخراج به نرم افزارهای پژوهشی:
شناسه ملی سند علمی:
ECME23_050
تاریخ نمایه سازی: 29 مهر 1403
چکیده مقاله:
در مجموعه داده های بزرگ استخراج ویژگی یکی از نکات کلیدی در زمینه های مختلف می باشد از طرفی استخراج متن که گاهی اوقات جهت تشخیص آنالیز متن کاوی نیز نامیده می شود یک تکنیک مورداستفاده جهت تحلیل متن است. هدف اصلی این تکنیک این است که کلمات و عبارات را از بدنه یک متن استخراج کند. استخراج متن یا کلمه موردنظر به طور گسترده ای، مورد آزمایش قرار گرفته است، پیشرفت کارایی این عمل هنوز بسیار پایین تر از اعمال اصلی پردازش زبان طبیعی است. از طرفی رشد فزاینده اسناد متنی برروی وب در مجموعه داده ها، ضرورت استفاده از ابزارهای پردازش خودکار متون را بیش از پیش آشکار می سازد. همچنین در اکثر روش های استخراج کلمات کلیدی در مجمعه داده ها، مفهوم و معنای متن نادیده گرفته می شوند. از طرفی دیگر، بدون ساختار بودن متون جدید در اخبار و اسناد الکترونیکی، استخراج این کلمات را مشکل می سازد. در گذشته جستجوی کلمات کلیدی به صورت دستی انجام می شد ولی محققان روش هایی را بکار بردند که جستجوی کلمات کلیدی و خلاصه سازی آن بصورت اتوماتیک انجام شود. در این تحقیق به بررسی و ارزیابی پیشرفت استخراج کلمات کلیدی اتوماتیک و بررسی منابع اصلی خطا در سیستم های موجود، پرداخته شده و در نهایت به رهیافت مبتنی بر گراف برای استخراج عبارات کلیدی به صورت خودکار بیان می شود.
کلیدواژه ها:
نویسندگان
سمیه نیک منش سیکارودی
کارشناسی مهندسی کامپیوتر-نرم افزار