🔍 آیا مدل‌های RAG وقتی اطلاعات غلط می‌گیرند، متوجه می‌شوند؟ 🧠🤖

⚠️ هشدار به محققان: چرا دقت مدل‌های شناسایی پهپاد گاهی «واقعی» نیست؟

تکنولوژی RAG (تولید با بازیابی) یکی از ستون‌های اصلی مدل‌های زبانی است، اما یک مشکل بزرگ دارد: وقتی داده‌های بازیابی شده با دانش قبلی مدل در تضاد هستند، مدل دقیقاً چطور تصمیم می‌گیرد؟

محققان در مقاله‌ای جدید با معرفی روش CDD، به بررسی «انطباق با متن» (Context Compliance) پرداخته‌اند. یافته‌های کلیدی:

1️⃣ داده‌های بازیابی شده‌ی گمراه‌کننده می‌توانند دقت مدل را تا ۱۵٪ کاهش دهند.
2️⃣ مدل‌های مختلف (مثل Gemini و Claude) رفتارهای متفاوتی در برابر تضاد دانش نشان می‌دهند.
3️⃣ روش جدید CDD به ما اجازه می‌دهد دقیقاً ببینیم مدل چطور بین دانش قبلی خود و اطلاعات دریافتی یکی را انتخاب می‌کند.

این تحقیق نشان می‌دهد که مدیریت «تضاد دانش» در RAG، بیشتر از اینکه یک مشکل فنی ساده باشد، یک چالش بزرگ در شفافیت و تحلیل رفتار مدل‌هاست. 🚀

منبع: arXiv AI