محققان در پژوهشی تازه، موضوع مهم «تشخیص اطلاعات» (Information Discernment) را در مدلهای زبانی بزرگ (LLM) بررسی کردند. نتایج نشان میدهد که مدلها در تشخیص اعتبار منابع و سنجش درستیِ ادعاها همچنان ضعف دارند و اغلب به جای «اعتبار منبع»، به «محبوبیت منبع» تکیه میکنند. 📉
این تیم با معرفی بنچمارک Learn2Discern (L2D)، به دنبال بهبود این نقطه ضعف حیاتی است تا هوش مصنوعی در آینده، جایگزین مطمئنتری برای جستجوی سنتی باشد. مدلها بزرگتر میشوند، اما آیا باهوشتر هم میشوند؟ این تحقیق پاسخهای جالبی دارد! 🔍✨
منبع: arXiv NLP
