🧠 آیا مدل‌های زبانی واقعاً درک درستی از حقیقت دارند؟

🧠 چرا هوش مصنوعی گاهی «خیالات» می‌بیند؟

محققان در پژوهشی تازه، موضوع مهم «تشخیص اطلاعات» (Information Discernment) را در مدل‌های زبانی بزرگ (LLM) بررسی کردند. نتایج نشان می‌دهد که مدل‌ها در تشخیص اعتبار منابع و سنجش درستیِ ادعاها همچنان ضعف دارند و اغلب به جای «اعتبار منبع»، به «محبوبیت منبع» تکیه می‌کنند. 📉

این تیم با معرفی بنچمارک Learn2Discern (L2D)، به دنبال بهبود این نقطه ضعف حیاتی است تا هوش مصنوعی در آینده، جایگزین مطمئن‌تری برای جستجوی سنتی باشد. مدل‌ها بزرگتر می‌شوند، اما آیا باهوش‌تر هم می‌شوند؟ این تحقیق پاسخ‌های جالبی دارد! 🔍✨

منبع: arXiv NLP