محققان بهتازگی آسیبپذیری جدیدی را در «مدلهای زبانی-تصویری مادونقرمز» (IR-VLMs) کشف کردهاند. این مدلها که در محیطهای کمنور برای تشخیص اشیاء استفاده میشوند، در برابر روش جدیدی به نام UCGP (پچهای متنی خمیده) بهشدت آسیبپذیر هستند.
در این روش، با چسباندن یک برچسب خاص و کوچک در دنیای واقعی، میتوان سیستمهای هوشمند را در تشخیص، توصیف تصاویر و پاسخ به سوالات بصری دچار خطا کرد. این تحقیق نشان میدهد که چگونه پچهای فیزیکی میتوانند امنیت سیستمهای بینایی مبتنی بر مادونقرمز را به چالش بکشند. 🔍
منبع: arXiv Computer Vision
