ارائه فرایندی جهت یکپارچه سازی و تشخیص تکرار برای بهبود کیفیت داده ها

سال انتشار: 1399
نوع سند: مقاله ژورنالی
زبان: فارسی
مشاهده: 166

فایل این مقاله در 13 صفحه با فرمت PDF قابل دریافت می باشد

استخراج به نرم افزارهای پژوهشی:

لینک ثابت به این مقاله:

شناسه ملی سند علمی:

JR_JSCIT-9-3_009

تاریخ نمایه سازی: 25 مهر 1403

چکیده مقاله:

اطلاعات در محیط های کاری امروزی و تصمیم گیری ها نقشی اساسی دارند. با توجه به اهمیت تصمیم گیری، اطمینان از کیفیت داده های موجود ضروری است. با استفاده از روش های پاک سازی داده می توان کیفیت داده ها را بهبود بخشید. در این مقاله فرایندی در جهت کشف انواع رکورد های تکراری و متناقض، یکپارچه سازی و تشخیص تکرار برای بهبود کیفیت داده ها ارائه می شود. فرایند پیشنهادی شامل بخش هایی ازجمله کد کردن داده ها و خوشه بندی با استفاده از الگوریتم امید ریاضی- بیشینه سازی، ساخت نشانه برای رکوردها، ادغام روش های کدکردن داده ها و ساخت نشانه و ایجاد قوانین انجمنی با استفاده از الگوریتم Fp-growth است. نتایج آزمایش ها نشان می دهد در فرایند پیشنهادی به طور متوسط معیار فراخوانی ۹۶%، صحت ۹۹%، دقت ۹۵% و امتیاز- اف ۹۵% شده است. روش پیشنهادی با یک روش شناسایی تکرار و خطا، مقایسه شده است که نتایج حاصل نشان دهنده ی افزایش ۱۳% فراخوانی، ۱% صحت و ۶% امتیاز- اف است.

کلیدواژه ها:

کیفیت داده ، عوامل کیفیت داده ها ، پاک سازی داده ها

نویسندگان

Niloofar Mollamohammad

دانشکده مهندسی برق و فناوری اطلاعات، واحد قزوین، دانشگاه آزاد اسلامی،قزوین، ایران.

Negin Daneshpour

دانشکده مهندسی کامپیوتر، دانشگاه تربیت دبیر شهید رجایی، تهران، ایران.

مراجع و منابع این مقاله:

لیست زیر مراجع و منابع استفاده شده در این مقاله را نمایش می دهد. این مراجع به صورت کاملا ماشینی و بر اساس هوش مصنوعی استخراج شده اند و لذا ممکن است دارای اشکالاتی باشند که به مرور زمان دقت استخراج این محتوا افزایش می یابد. مراجعی که مقالات مربوط به آنها در سیویلیکا نمایه شده و پیدا شده اند، به خود مقاله لینک شده اند :
  • K. Ali and M. Warraich," A framework to implement Data ...
  • D.Luebbers, U. Grimmer, and M.Jarke," Systematic Development of Data Mining-Based ...
  • J.Han and M.Kamber,"Data Mining: Concepts and Techniques," ۳th ed. Morgan ...
  • K.Sarpong, K. Adu-Manu, and J. Kingsley Arthur,"A Review of Data ...
  • B.Pinar," A Comparison of Data Warehouse Design Models," M.S. thesis, ...
  • E. Rahm and H. Hai Do," Data Cleaning: Problems and ...
  • J.Broeck, S.A. Cunningham, R.Eeckels and K.Herbst,"Data Cleaning: Detecting, Diagnosing, and ...
  • L.Ettinger,"Improving the DataWarehouse with Selected Data Quality Techniques: Metadata Management, ...
  • H.Muller and J.Christoph Freytag," Problems, Methods, and Challenges in Comprehensive ...
  • R.Arora, P.Pahwa, and S.Bansal," Alliance Rules for Data Warehouse Cleansing",in ...
  • M.Hamad and A.Jihad," An Enhanced Technique to Clean Data in ...
  • Y.Hao,D.Xing-chun, and L.Kai-qi,"Research on Information Quality Driven Data Cleaning Framework,"in ...
  • M.Rehman and V.Esichaikul,"Duplicate Record Detection For Database Cleansing.in Machine Vision,"in ...
  • R.Kavitha Kumar and RM.CHADRASEKARAN,"Attribute Correction-Data Cleaning Using Association Rule and ...
  • O.Abbas ," Comparisons between data clustering algorithm", Computer science Department, ...
  • C.Mayfield, J.Neville, and S. Prabhakar,"A Statistical Method for Integrated Data ...
  • A. Hoshino,H.Nakayama,K. Kanno, and K.Nishimura ,"Leveraging the Common Cause of ...
  • J.Gu," Random Forest Based Imbalanced Data Cleaning and Classification," ۲۰۰۷ ...
  • M.Bergman, T.Milo, S.Novgorodov and W.Tan,"QOCO: A Query Oriented Data Cleaning ...
  • M.Bergman, T.Milo, S.Novgorodov and W.Tan,"Query-oriented data cleaning with oracles," in ...
  • V.Raman and M.Hellerstein," Potter’sWheel: An Interactive Data Cleaning System,"in ۲۷th ...
  • M.Rehman andV. Esichaikul ,"Duplicate Record Detection For Database Cleansing".in Machine ...
  • K.Ripon and A.Rahman,"A Domain-Independent Data Cleaning Algorithm for Detecting Similar-Duplicates," ...
  • J.Tamilselvi and V.Saravanan,"A Unified Framework and Sequential Data Cleaning Approach ...
  • E.Ohanekwu and C.I. Ezeife," A Token-Based Data Cleaning Technique for ...
  • R.KavithaKumar and RM.Chadrasekaran, "Attribute Correction-Data Cleaning Using Association Rule and ...
  • H.Yu, Z.Xiao-yi, and Y.Zhen, "A Universal Data Cleaning Framework Based ...
  • W.Wei and M.Zhang, and B, Zhang and X.Tang,"A Data Cleaning ...
  • J.Han and H. Pei H, and Y. Yin," Mining Frequent ...
  • A.Paul, V.Ganesan, JS. Challa and Y.Sharma,"HADCLEAN: A Hybrid Approach to ...
  • B.Khan, A.Rauf, H.Javed and S.Khusro,"Removing Fully and Partially Duplicated Records ...
  • I.Kononenko and S. Hong," Attribute Selection for Modeling", Future Generation ...
  • J.Wang,"Data warehousing and mining: concept, methodologies, tools, and appplications," in ...
  • G.Venkatesh and A. Sarma," Data Cleaning A Practical Perspective", Morgan ...
  • C. Borgelt, "An Implementation of the FP-growth Algorithm," in ۱st international ...
  • نمایش کامل مراجع