محققان در یک پژوهش جدید، حفره امنیتی خطرناکی را در مدلهای زبانی چندوجهی (MLLM) کشف کردهاند که میتواند حافظه بصری آنها را هدف قرار دهد. این فریمورک که Lucid نام دارد، با استفاده از تغییرات نامحسوس در تصاویر، میتواند مدلهای هوشمند را فریب دهد تا اطلاعات اشتباه را در «حافظه بلندمدت» خود ذخیره کنند یا روایتهای ساختگیِ مدنظر مهاجم را بپذیرند.
این یعنی هوش مصنوعی که ما برای درک محیط و تحلیل تاریخچه مکالمات به آن اعتماد داریم، ممکن است با یک تصویر دستکاریشده به راحتی منحرف شود. این کشف، زنگ خطری جدی برای توسعهدهندگان سیستمهای چندوجهی و امنیت دادههاست.
منبع: arXiv Computer Vision
