آیا مدلهای هوش مصنوعی واقعاً اطلاعات را درست بازیابی میکنند؟ یک تحقیق جدید نشان میدهد که بسیاری از سیستمهای حافظه در LLMها (مدلهای زبانی بزرگ) بیشتر از اینکه «دقیق» باشند، فقط اطلاعات را «توده» میکنند. این یعنی وقتی از آنها سوالی میپرسیم، ممکن است پاسخهای درست را با نویزهای غیرمرتبط ترکیب کنند.
محققان برای حل این مشکل، بنچمارک جدیدی به نام PrecisionMemBench را معرفی کردهاند که دقت واقعی و توانایی مدلها در تفکیک حافظه را میسنجد. همچنین ابزاری به نام Tenure معرفی شده که با ساختاردهی به دادهها قبل از ورود به مدل، باعث میشود حافظه هوش مصنوعی بسیار دقیقتر و قابلاعتمادتر عمل کند.
این پیشرفتها برای توسعهدهندگانی که با سیستمهای RAG و ایجنتهای هوشمند سروکار دارند، گامی بزرگ به سوی کاربردیتر کردن هوش مصنوعی در محیطهای سازمانی است. 🚀
منبع: arXiv AI
