محققان در پژوهش جدیدی، راهکار نوآورانهای برای «بخشبندی تصاویر غذا» (Food Image Segmentation) ارائه دادهاند. چالش اصلی در این حوزه، شباهت ظاهری مواد غذایی مختلف است که باعث خطا در مدلهای قبلی میشد.
این تیم با استفاده از دانش مدلهای زبانی بزرگ (LLM)، ماژولهای جدیدی طراحی کردهاند که میتوانند بدون نیاز به فرآیندهای پیچیده پیشتطبیق، اطلاعات معنایی مواد تشکیلدهنده غذا را مستقیماً به مدلهای بینایی تزریق کنند. نتیجه؟ کسب رکورد جدید و خیرهکننده در دقت تحلیل تصاویر غذایی که میتواند تحولی در اپلیکیشنهای سلامت و کالریشماری باشد. 🥗📉
منبع: arXiv Computer Vision
