مرکز اطلاعات علمی Scientific Information Database (SID) - Trusted Source for Research and Academic Resources

مقاله مقاله نشریه

مشخصات مقاله

مرکز اطلاعات علمی Scientific Information Database (SID) - Trusted Source for Research and Academic Resources

نسخه انگلیسی

مرکز اطلاعات علمی Scientific Information Database (SID) - Trusted Source for Research and Academic Resources

video

مرکز اطلاعات علمی Scientific Information Database (SID) - Trusted Source for Research and Academic Resources

sound

مرکز اطلاعات علمی Scientific Information Database (SID) - Trusted Source for Research and Academic Resources

نسخه انگلیسی

مرکز اطلاعات علمی Scientific Information Database (SID) - Trusted Source for Research and Academic Resources

بازدید:

4
مرکز اطلاعات علمی Scientific Information Database (SID) - Trusted Source for Research and Academic Resources

دانلود:

مرکز اطلاعات علمی Scientific Information Database (SID) - Trusted Source for Research and Academic Resources

استناد:

اطلاعات مقاله نشریه

عنوان

توصیف محتوای تصاویر به صورت خودکار با بکارگیری شبکه عصبی کپسولی و روش تعبیه سازی ELMo

صفحات

 صفحه شروع 75 | صفحه پایان 91

چکیده

 توصیف­ محتوای تصویر به­ صورت خودکار توسط ماشین یک مشکل چالش ­برانگیز در بینایی کامپیوتر است و هدف آن تولید توضیحات قابل درک توسط کامپیوتر برای تصاویر می­باشد. استفاده از شبکه ­های عصبی پیچشی (CNN) نقش مهمی در زمینه  توصیف تصاویر ایفا کرده است. با این حال, در طول فرآیند تولید توصیف های مرتبط با تصویر دو چالش عمده برای CNN وجود دارد که عبارتند از: عدم توجه آنها به روابط و ساختارهای سلسله مراتبی مکانی بین اشیای درون تصویر, و عدم ثبات در مقابل تغییرات چرخشی تصاویر. به ­منظور رفع این چالش­ ها این مقاله با بهره­ گیری از یک شبکه کپسولی بهبود یافته, به توصیف محتوای تصویر با استفاده از پردازش زبان­ طبیعی می­پردازد. شبکه کپسولی با درنظر گرفتن موقعیت مکانی اشیای درون تصویر نسبت به یکدیگر,  اطلاعات مربوط به محتوای تصویر را ارائه می­دهد. یک کپسول شامل مجموعه ای از نورون ها است که پارامترهای وضعیت اشیا درون تصویر مانند سایز, جهت, مقیاس و روابط اشیا نسبت به هم را در نظر می گیرند. این کپسول ­ها تمرکز ویژه­ای بر استخراج ویژگی­ های معنادار برای استفاده در فرآیند تولید توضیحات مرتبط برای مجموعه­ ای معین از تصاویر دارند. آزمایش های کیفی روی مجموعه داده های MS-COCO با بهره­ گیری از شبکه کپسولی و روش تعبیه ­سازی ELMo, منجر به بهبود 2 تا 5 درصدی معیارهای ارزیابی شده, در مقایسه با مدل های زیرنویس تصویر موجود شده است.

استنادها

  • ثبت نشده است.
  • ارجاعات

  • ثبت نشده است.
  • استناددهی

    مقالات مرتبط نشریه ای

  • ثبت نشده است.
  • مقالات مرتبط همایشی

  • ثبت نشده است.
  • طرح های مرتبط

  • ثبت نشده است.
  • کارگاه های پیشنهادی






    بازگشت به بالا
    telegram sharing button
    whatsapp sharing button
    linkedin sharing button
    twitter sharing button
    email sharing button
    email sharing button
    email sharing button
    sharethis sharing button