بررسی تطبیقی روش های کدگذاری Unicode و تحلیل کارایی UTF-۸، UTF-۱۶ و UTF-۳۲ در سامانه های پردازش متن چندزبانه
سال انتشار: 1405
نوع سند: مقاله کنفرانسی
زبان: فارسی
مشاهده: 95
فایل این مقاله در 7 صفحه با فرمت PDF قابل دریافت می باشد
- صدور گواهی نمایه سازی
- من نویسنده این مقاله هستم
استخراج به نرم افزارهای پژوهشی:
شناسه ملی سند علمی:
ECME31_081
تاریخ نمایه سازی: 28 تیر 1405
چکیده مقاله:
استاندارد Unicode به عنوان پایه اصلی نمایش و پردازش متون چندزبانه، نقش مهمی در توسعه سامانه های نرم افزاری، وب، پایگاه های داده و فناوری های ارتباطی ایفا می کند. با وجود پشتیبانی کامل روش هایUTF-۸ ، UTF-۱۶و UTF-۳۲ از نویسه هایUnicode ، تفاوت در ساختار کدگذاری آن ها موجب تفاوت در مصرف حافظه، سرعت پردازش، حجم داده های ذخیره سازی و میزان سازگاری با محیط های نرم افزاری شده است. هدف این پژوهش، بررسی تطبیقی این سه روش کدگذاری و تحلیل ویژگی های فنی، مزایا، محدودیت ها و حوزه های کاربرد هر یک در سامانه های پردازش متن چندزبانه است. این پژوهش با استفاده از روش تحقیق توصیفی–تحلیلی و بر پایه مطالعه منابع علمی معتبر، مستندات فنی و استانداردهای بین المللی انجام شده است. در این مطالعه، عملکرد روش هایUTF-۸ ، UTF-۱۶و UTF-۳۲ از نظر نحوه ذخیره سازی نویسه ها، میزان مصرف حافظه، کارایی در پردازش متون، سازگاری با سیستم عامل ها، زبان های برنامه نویسی، پایگاه های داده و فناوری های وب مورد ارزیابی و مقایسه قرار گرفت. نتایج نشان می دهد که UTF-۸ به دلیل سازگاری با ASCII ، مصرف بهینه حافظه در بسیاری از کاربردها و پشتیبانی گسترده در فناوری های نوین، مناسب ترین گزینه برای اغلب سامانه های نرم افزاری و بسترهای اینترنتی است. همچنین UTF-۱۶ در برخی محیط های نرم افزاری با حجم بالای پردازش متنی عملکرد مطلوبی دارد و UTF-۳۲با وجود سادگی ساختار و سهولت دسترسی مستقیم به نویسه ها، به دلیل مصرف بالای حافظه بیشتر در کاربردهای تخصصی مورد استفاده قرار می گیرد. یافته های این پژوهش می تواند راهنمای مناسبی برای انتخاب روش کدگذاری متناسب با نیازهای فنی و الزامات عملکردی در طراحی و توسعه سامانه های نرم افزاری چندزبانه باشد.
کلیدواژه ها:
نویسندگان
فاطمه نادری
۱- دانشجوی کاردانی فناوری اطلاعات دانشگاه ولیعصر
نسترن بیرانوند
۲- استاد دانشگاه ولیعصر