یکی از مشکلات اصلی سیستمهای بازیابی و تولید (RAG) این است که گاهی اوقات دادههای دریافتی حاوی اطلاعات گمراهکننده یا غلط هستند که خروجی مدل را تحت تأثیر قرار میدهند.
محققان ابزاری به نام MIRAGE معرفی کردهاند که بدون نیاز به آموزش مجدد، میتواند در مقابل «آلودگی اطلاعات» در سیستمهای RAG دفاع کند. این متد با بررسی چندین منبع مختلف و ساخت یک گراف از ادعاها، فقط به اطلاعات تایید شده اعتماد میکند.
اگر در حوزه توسعه مدلهای زبانی یا سیستمهای پرسش و پاسخ فعالیت میکنید، این ابزار میتواند دقت و اعتبار مدل شما را بهطور چشمگیری افزایش دهد.
🔗 لینک گیتهاب پروژه:
https://github.com/SaadElDine/MIRAGE
منبع: arXiv NLP
