محققان در مطالعهای جدید، پدیده «پاریدولیا» (Pareidolia) یا همان دیدن چهره در اشیاء بیجان را در مدلهای بینایی ماشین بررسی کردند. نتایج این تحقیق نشان میدهد که مدلهای زبانی-تصویری (VLM) مثل LLaVA تمایل عجیبی به تفسیر اشتباه الگوهای مبهم به عنوان «چهره انسان» دارند (بهویژه در تصاویر با احساسات منفی).
این در حالی است که مدلهای تخصصیتر، برخورد بسیار محافظهکارانهتری دارند. این پژوهش گام مهمی برای درک نحوه قضاوت هوش مصنوعی در شرایط ابهام و افزایش دقت و «هوشمندی واقعی» سیستمهای بینایی است. 🤖🔎
منبع: arXiv AI
