ناشر تخصصی کنفرانس های ایران

لطفا کمی صبر نمایید

Publisher of Iranian Journals and Conference Proceedings

Please waite ..
ناشر تخصصی کنفرانسهای ایران
ورود |عضویت رایگان |راهنمای سایت |عضویت کتابخانه ها
عنوان
مقاله

بهبود بازشناسی متن فارسی: ارایه یک روش تکمیلی بر پایه حذف نقاط حروف

سال انتشار: 1396
کد COI مقاله: IPRIA03_043
زبان مقاله: فارسیمشاهده این مقاله: 328
فایل این مقاله در 5 صفحه با فرمت PDF قابل دریافت می باشد

خرید و دانلود فایل مقاله

با استفاده از پرداخت اینترنتی بسیار سریع و ساده می توانید اصل این مقاله را که دارای 5 صفحه است به صورت فایل PDF در اختیار داشته باشید.
آدرس ایمیل خود را در کادر زیر وارد نمایید:

مشخصات نویسندگان مقاله بهبود بازشناسی متن فارسی: ارایه یک روش تکمیلی بر پایه حذف نقاط حروف

محمدمحسن طلایی - دانشجو، گروه مهندسی کامپیوتر و فناوری اطلاعات، دانشگاه پیام نور، تهران، ایران
محسن امامی - مربی، گروه مهندسی کامپیوتر و فناوری اطلاعات، دانشگاه پیام نور، تهران، ایران

چکیده مقاله:

سیستم های (Optical Character Recognition) OCR به سیستم هایی اطلاق می شود که قادرند تصاویر دیجیتالی از متون چاپی را بهکاراکتر های دیجیتالی تبدیل کنند. OCR به روشهای گوناگونی پیاده سازی شده است که در حال حاضر کارآمدترین آنها برای زبان فارسی،استفاده از شبکه عصبی است. در این روش، حروف موجود در عکس به صورت یک به یک به شبکه عصبی ارسال شده و کاراکتر دیجیتالی نظیر هرحرف تشخیص داده میشود. اما یکی از بزرگترین چالش های پیش روی این دست از الگوریتمها وجود نقاط در بالا و پایین حروف در رسم الخطفارسی است. هدف اصلی در این پژوهش ارایه یک متد تکمیلی در OCR فارسی است که با حذف هوشمندانه نقاط حروف، به بهبود کیفیت جداسازیحروف کمک میکند. این روش با تشکیل نمودار هیستوگرام افقی و محاسبه خط مبنا و با استفاده از ایده اصلی روش برچسب گذاری به همراهتغییرات ایجاد شده، نقاط را حذف می کند. نتایج به دست آمده از پیاده سازی این روش نشان دهنده موفقیت در حذف همه نقاط در فونت هایپرکاربرد فارسی و بهبود حداقل % 17 کیفیت تشخیص نسبت به روش مرجع است.

کلیدواژه ها:

پردازش تصویر، تشخیص متن، OCR

کد مقاله/لینک ثابت به این مقاله

کد یکتای اختصاصی (COI) این مقاله در پایگاه سیویلیکا IPRIA03_043 میباشد و برای لینک دهی به این مقاله می توانید از لینک زیر استفاده نمایید. این لینک همیشه ثابت است و به عنوان سند ثبت مقاله در مرجع سیویلیکا مورد استفاده قرار میگیرد:

https://civilica.com/doc/638494/

نحوه استناد به مقاله:

در صورتی که می خواهید در اثر پژوهشی خود به این مقاله ارجاع دهید، به سادگی می توانید از عبارت زیر در بخش منابع و مراجع استفاده نمایید:
طلایی، محمدمحسن و امامی، محسن،1396،بهبود بازشناسی متن فارسی: ارایه یک روش تکمیلی بر پایه حذف نقاط حروف،سومین کنفرانس بین المللی بازشناسی الگو و تحلیل تصویر ایران،شهرکرد،،،https://civilica.com/doc/638494

در داخل متن نیز هر جا که به عبارت و یا دستاوردی از این مقاله اشاره شود پس از ذکر مطلب، در داخل پارانتز، مشخصات زیر نوشته می شود.
برای بار اول: (1396، طلایی، محمدمحسن؛ محسن امامی)
برای بار دوم به بعد: (1396، طلایی؛ امامی)
برای آشنایی کامل با نحوه مرجع نویسی لطفا بخش راهنمای سیویلیکا (مرجع دهی) را ملاحظه نمایید.

مدیریت اطلاعات پژوهشی

صدور گواهی نمایه سازی | گزارش اشکال مقاله | من نویسنده این مقاله هستم
این مقاله در بخشهای موضوعی زیر دسته بندی شده است:

اطلاعات استنادی این مقاله را به نرم افزارهای مدیریت اطلاعات علمی و استنادی ارسال نمایید و در تحقیقات خود از آن استفاده نمایید.

علم سنجی و رتبه بندی مقاله

مشخصات مرکز تولید کننده این مقاله به صورت زیر است:
نوع مرکز: پیام نور
تعداد مقالات: 52,742
در بخش علم سنجی پایگاه سیویلیکا می توانید رتبه بندی علمی مراکز دانشگاهی و پژوهشی کشور را بر اساس آمار مقالات نمایه شده مشاهده نمایید.

مقالات پیشنهادی مرتبط

مقالات مرتبط جدید

به اشتراک گذاری این صفحه

اطلاعات بیشتر درباره COI

COI مخفف عبارت CIVILICA Object Identifier به معنی شناسه سیویلیکا برای اسناد است. COI کدی است که مطابق محل انتشار، به مقالات کنفرانسها و ژورنالهای داخل کشور به هنگام نمایه سازی بر روی پایگاه استنادی سیویلیکا اختصاص می یابد.

کد COI به مفهوم کد ملی اسناد نمایه شده در سیویلیکا است و کدی یکتا و ثابت است و به همین دلیل همواره قابلیت استناد و پیگیری دارد.

پشتیبانی