🚀 ارتقای دقت مدل‌های زبانی با استفاده از مکانیسم توجه (Attention)!

🧠 چرا هوش مصنوعی گاهی «خیالات» می‌بیند؟

محققان در یک پژوهش جدید، راهکاری هوشمندانه برای بهبود «واقع‌گرایی» (Factuality) مدل‌های زبانی بزرگ ارائه داده‌اند. روش‌های پیشین مانند DoLa برای انتخاب لایه‌های مدل از تحلیل توزیع کلمات استفاده می‌کردند، اما این متد جدید با بهره‌گیری از داده‌های ساختاریافته در مکانیزم توجه (Attention)، سیگنال‌های دقیق‌تری برای انتخاب لایه‌ها شناسایی می‌کند.

نتایج آزمایش‌ها روی مجموعه داده TruthfulQA نشان می‌دهد که استراتژی‌های جدید (مانند Attention-JSD)، عملکرد مدل را در پاسخ‌دهی دقیق به سوالات چندگزینه‌ای به‌طور محسوسی بهبود می‌بخشند. این یعنی مدل‌های ما در آینده کمتر دچار «توهم» (Hallucination) شده و پاسخ‌های واقعی‌تری ارائه خواهند داد. 🧠💡

منبع: arXiv NLP