محققان به تازگی تکنیک جدیدی برای «جیلبریک» (Jailbreak) کردن مدلهای بزرگ بینایی-زبانی (LVLMs) کشف کردهاند. این روش با نام «Overloading»، با ترکیب دادههای متنی حجیم و تصاویر چندبعدی، امنیت این مدلها را به چالش میکشد.
نتایج نشان میدهد که این متد جدید میتواند با موفقیت بیش از ۸۸٪ از سدهای امنیتی مدلهای متنباز و ۸۴٪ از مدلهای تجاری را دور بزند! این یافته زنگ خطری جدی برای توسعهدهندگان است تا به فکر روشهای مقاومسازی جدیدی برای جلوگیری از سوءاستفادههای احتمالی باشند.
منبع: arXiv Computer Vision
