ارائه فرایندی جهت یکپارچه سازی و تشخیص تکرار برای بهبود کیفیت داده ها
سال انتشار: 1399
نوع سند: مقاله ژورنالی
زبان: فارسی
مشاهده: 166
فایل این مقاله در 13 صفحه با فرمت PDF قابل دریافت می باشد
- صدور گواهی نمایه سازی
- من نویسنده این مقاله هستم
استخراج به نرم افزارهای پژوهشی:
شناسه ملی سند علمی:
JR_JSCIT-9-3_009
تاریخ نمایه سازی: 25 مهر 1403
چکیده مقاله:
اطلاعات در محیط های کاری امروزی و تصمیم گیری ها نقشی اساسی دارند. با توجه به اهمیت تصمیم گیری، اطمینان از کیفیت داده های موجود ضروری است. با استفاده از روش های پاک سازی داده می توان کیفیت داده ها را بهبود بخشید. در این مقاله فرایندی در جهت کشف انواع رکورد های تکراری و متناقض، یکپارچه سازی و تشخیص تکرار برای بهبود کیفیت داده ها ارائه می شود. فرایند پیشنهادی شامل بخش هایی ازجمله کد کردن داده ها و خوشه بندی با استفاده از الگوریتم امید ریاضی- بیشینه سازی، ساخت نشانه برای رکوردها، ادغام روش های کدکردن داده ها و ساخت نشانه و ایجاد قوانین انجمنی با استفاده از الگوریتم Fp-growth است. نتایج آزمایش ها نشان می دهد در فرایند پیشنهادی به طور متوسط معیار فراخوانی ۹۶%، صحت ۹۹%، دقت ۹۵% و امتیاز- اف ۹۵% شده است. روش پیشنهادی با یک روش شناسایی تکرار و خطا، مقایسه شده است که نتایج حاصل نشان دهنده ی افزایش ۱۳% فراخوانی، ۱% صحت و ۶% امتیاز- اف است.
کلیدواژه ها:
نویسندگان
Niloofar Mollamohammad
دانشکده مهندسی برق و فناوری اطلاعات، واحد قزوین، دانشگاه آزاد اسلامی،قزوین، ایران.
Negin Daneshpour
دانشکده مهندسی کامپیوتر، دانشگاه تربیت دبیر شهید رجایی، تهران، ایران.
مراجع و منابع این مقاله:
لیست زیر مراجع و منابع استفاده شده در این مقاله را نمایش می دهد. این مراجع به صورت کاملا ماشینی و بر اساس هوش مصنوعی استخراج شده اند و لذا ممکن است دارای اشکالاتی باشند که به مرور زمان دقت استخراج این محتوا افزایش می یابد. مراجعی که مقالات مربوط به آنها در سیویلیکا نمایه شده و پیدا شده اند، به خود مقاله لینک شده اند :