محققان در یک پژوهش جدید، نکته بسیار مهمی را درباره «اعتماد» (Confidence) مدلهای بینایی ماشین کشف کردهاند. این مطالعه نشان میدهد که دتکتورهای قدرتمند (مثل Grounding DINO یا SAM) وقتی شیئی در تصویر تا حد زیادی توسط اشیاء دیگر پوشانده میشود، همچنان با اطمینان بالا اعلام میکنند که آن شیء را دیدهاند!
در واقع، این مدلها به جای تشخیص «دیده شدن» آن شیء خاص، صرفاً وجود «آن دسته از اشیاء» را در محیط حس میکنند و نمیتوانند تفاوت بین یک شیء واضح و یک شیء پنهان در پشت موانع را به درستی تشخیص دهند. این موضوع برای توسعهدهندگان سیستمهای خودران و رباتیک بسیار حیاتی است، چرا که نشان میدهد اعتماد بالای مدل همیشه به معنای دیدِ مستقیم نیست.
این یافتهها زنگ خطری برای نحوه ارزیابی و آموزش مدلهای آینده در درک محیطهای پیچیده و شلوغ است. 🤖🧠
منبع: arXiv Computer Vision
