بهبود کارایی در خلاصه سازی ویدیو با استفاده از شبکه هایعصبی
- سال انتشار: 1401
- محل انتشار: پنجمین همایش ملی توسعه علوم فناوریهای نوین در مدیریت، حسابداری و کامپیوتر
- کد COI اختصاصی: IVCONF05_075
- زبان مقاله: فارسی
- تعداد مشاهده: 228
نویسندگان
دانشگاه تهرانمهندسی فناوری اطلاعات-گرایش شبکه های ارتباطی و کامپیوتری
چکیده
در این تحقیق با توجه به عدم وجود مجموعه داده از صدای گزارشگرمجموعه داده صوتی به زبان انگلیسی شامل بیان ۲۱ کلمه فوتبالیجمع آوری شده است که هر کلمه مجموعا ۲۱۰۰ بار توسط ۷۰۰ نفر متفاوتبیان شده است. شبکه تشخیص کلمه پیشنهادی که شبکه ای مبتنی بر لایه هایکانولوشنی و شبکه های بازگشتی است بر روی این مجموعه داده توانستهاست به دقت ۸۵.۸ درصدی برسد. مجموعه داده جمع آوری شده دیگر شامل۶۲۷۷ ویدیو در ۱۲ رویداد مختلف بوده است که هدف از جمع آوری آنایجاد مجموعه داده ای از رویدادهای مختلف با ابتدا و انتهای مشخصاز آن رویداد بوده است. شبکه عصبی پیشنهادی برای طبقه بندی ویدیوبه طور هم زمان از یادگیری عمیق و یادگیری کم عمق استفاده می کند. ازیادگیری عمیق در راستای استخراج ویژگی های محلی که از ارزش بالاییبرای تشخیص نوع ویدیو برخوردار هستند استفاده می شود و از یادگیریکم عمق در راستای استخراج ویژگی های زمانی استفاده می شود. روشپیشنهادی ۶.۲ درصد دقیق تر از سایر روش های طبقه ویدیو در فوتبال استو درعین حال حدود ۲۹ درصد محاسبات کمتری نسبت به بهترین شبکه عصبیمشابه نیاز دارد. در مجموع با استفاده از شبکه تشخیص صحنه و اعمالشبکه طبقه بندی کننده ویدیو بر روی ویدیو، دقت الگوریتم تشخیص رویداددر طول یک مسابقه فوتبال به ۸۸.۷۳ درصد می رسد. همچنین با اضافه شدنصدای گزارشگر دقت آشکارسازی رویداد ۱.۶۴ درصد و با افزودن صدایتماشاگر دقت ۰.۶۳ درصد افزایش می یابد تا در نهایت دقت آشکارسازیرویداد روش پیشنهادی با استفاده هم زمان از ویدیو، صدای تماشاگر وگزارشگر به ۹۱ درصد برسد.کلیدواژه ها
خلاصه سازی ویدیو، شبکه عصبی، یادگیری عمیق، ویدیوفوتبال، تشخیص رویدادمقالات مرتبط جدید
اطلاعات بیشتر در مورد COI
COI مخفف عبارت CIVILICA Object Identifier به معنی شناسه سیویلیکا برای اسناد است. COI کدی است که مطابق محل انتشار، به مقالات کنفرانسها و ژورنالهای داخل کشور به هنگام نمایه سازی بر روی پایگاه استنادی سیویلیکا اختصاص می یابد.
کد COI به مفهوم کد ملی اسناد نمایه شده در سیویلیکا است و کدی یکتا و ثابت است و به همین دلیل همواره قابلیت استناد و پیگیری دارد.