تولید تصاویر متنی به تصویری با هوش مصنوعی مولد: تکنیک ها، ارزیابی کیفیت و کاربردها
سال انتشار: 1405
نوع سند: مقاله کنفرانسی
زبان: فارسی
مشاهده: 9
فایل این مقاله در 6 صفحه با فرمت PDF قابل دریافت می باشد
- صدور گواهی نمایه سازی
- من نویسنده این مقاله هستم
استخراج به نرم افزارهای پژوهشی:
شناسه ملی سند علمی:
ECICONFE10_165
تاریخ نمایه سازی: 22 شهریور 1405
چکیده مقاله:
هوش مصنوعی مولد در حوزه تولید تصاویر متنی به تصویری (Text-to-Image Generation) به سرعت پیشرفت کرده و توانسته است توصیفات متنی را به تصاویر با کیفیت بالا تبدیل کند. این فناوری با بهره گیری از مدل هایی مانند شبکه های مولد (GANs) و به ویژه مدل های انتشار (Diffusion Models)، امکان تولید تصاویر واقع گرایانه یا خلاقانه را فراهم آورده است [۱]. مقاله حاضر به بررسی تکنیک های اصلی این حوزه، روش های ارزیابی کیفیت خروجی ها و کاربردهای آن در صنایع خلاق، طراحی و آموزش می پردازد. ابتدا مفهوم و ساختار مدل های مولد مورد تحلیل قرار می گیرد، سپس تکنیک ها و معیارهای ارزیابی کیفیت مانند Fréchet Inception Distance (FID) و CLIP Score معرفی می شوند [۴][۵]. در ادامه، کاربردهای عملی فناوری در حوزه های مختلف بررسی شده، مزایا و تاثیرات آن مطرح می گردد و چالش های فنی و ارزیابی مورد بحث قرار می گیرد. نمونه های موفق پیاده سازی نیز به عنوان شاهد ارائه می شود. در پایان، نتیجه گیری و چشم انداز آینده این فناوری با تمرکز بر بهبود کنترل پذیری و یکپارچگی با مدل های چندوجهی مطرح خواهد شد [۱][۳].
کلیدواژه ها:
هوش مصنوعی مولد ، تولید تصاویر متنی به تصویری ، مدل های انتشار ، ارزیابی کیفیت ، کاربردهای خلاقانه ، تکنیک های تولید تصویر
نویسندگان
محمدرضا سلمانی
دانشجوی رشته نرم افزار دانشگاه انقلاب اسلامی تهران
محمدعلی چناری
دانشجوی رشته نرم افزار دانشگاه انقلاب اسلامی تهران
امین یوسفلی
استاد دانشگاه، دانشگاه انقلاب اسلامی تهران