محققان به تازگی یک حفره امنیتی جدی در مدلهای بزرگ بینایی-زبانی (LVLM) کشف کردهاند که از طریق «تکنیک دستکاری توکنهای بصری» عمل میکند. این حمله (VTM-Attack) که در محیطهای ابری-لبه (Cloud-Edge) رخ میدهد، میتواند تنها با تغییر ۱۰ درصد از توکنهای ارسالی، دقت مدل را تا ۸۸ درصد کاهش دهد! این یعنی هکرها میتوانند بدون دسترسی کامل به مدل، تصمیمگیری آن را مختل کنند. این پژوهش زنگ خطری جدی برای توسعهدهندگانی است که از معماریهای توزیعشده استفاده میکنند. 🛡️💻
منبع: arXiv AI
