🔍 جلوگیری از توهم (Mirage) در مدل‌های بینایی-زبانی: معرفی روش TC-LIA

🧠 چرا هوش مصنوعی گاهی «خیالات» می‌بیند؟

آیا مدل‌های هوش مصنوعی وقتی جواب سؤالی را نمی‌دانند، نباید اعتراف کنند؟ محققان با شناسایی یک مشکل جدید به نام «Mirage» در مدل‌های VLM، متوجه شده‌اند که این مدل‌ها گاهی بدون هیچ سند بصری، با اعتمادبه‌نفس کامل پاسخ‌های نادرستی تولید می‌کنند!

برای حل این مشکل حیاتی (به‌ویژه در حوزه‌های حساسی مثل پزشکی)، روش جدیدی به نام «TC-LIA» معرفی شده است. این سیستم با بررسی لایه‌های مختلف مدل، تحلیل می‌کند که آیا مدل واقعاً شواهدی در تصویر دیده یا صرفاً در حال حدس زدن است. اگر شواهد کافی نباشد، سیستم ترجیح می‌دهد «ابراز بی‌اطلاعی» کند تا اینکه پاسخ غلط به کاربر ارائه دهد. 🛡️✨

منبع: arXiv AI