مدلهای چندوجهی هوش مصنوعی (MLLMs) این روزها در تحلیل نمودارها و تصاویر حرفهای زیادی برای گفتن دارند، اما یک سوال مهم همیشه باقی است: آیا این تحلیلها واقعاً بر اساس دادههای نمودار است یا مدلها صرفاً حدس میزنند؟
پژوهشگران در مطالعهای جدید روی بیش از ۱۰۰۰ توصیفِ تولید شده توسط مدلهایی مثل GPT و Gemini، بررسی کردند که این هوش مصنوعیها چقدر به شواهد واقعی پایبندند. نتیجه جالب بود: حتی با در اختیار داشتن تصویر، مدلها هنوز تمایل دارند برخی توضیحات را بر اساس حدسیات (Speculative) ارائه دهند تا شواهد مستقیم (Direct).
این تحقیق گام مهمی است برای اینکه در آینده بتوانیم بین «تفسیر واقعی مبتنی بر داده» و «خیالپردازی مدل» تمایز قائل شویم. گامی کلیدی برای شفافیت بیشتر در گزارشهای علمی و تجاری مبتنی بر هوش مصنوعی! 📊🤖
منبع: arXiv AI
