محققان در پژوهشی جدید به موضوع جالبی دست پیدا کردند: «ناسازگاری رفتاری» در مدلهای زبانی! بررسیها نشان میدهد وقتی یک ایجنت هوش مصنوعی، یک مسئله را چندین بار حل میکند و به نتایج متفاوتی میرسد، همین «اختلاف نظر با خود» میتواند بهترین معیار برای تشخیص عدم قطعیت و دقت پاسخ باشد.
نکته کلیدی این تحقیق این است که اگر ایجنت در اکثر دفعات به نتایج مشابهی برسد (ثبات رفتاری)، دقت آن تا ۸۷٪ افزایش مییابد. این روش نهتنها نیازی به آموزش مجدد ندارد، بلکه به توسعهدهندگان کمک میکند تا در پروژههای پیچیده و ایجنتیک، بفهمند چه زمانی هوش مصنوعی «مطمئن» است و چه زمانی در حال حدس و گمان! 🚀
منبع: arXiv AI
