محققان به تازگی کشف کردهاند که برای تشخیص رفتارهای نادرست مدلهای زبانی (مثل چاپلوسی یا حافظه کاذب)، نیازی به مدلهای غولآسا نیست! این تیم با طراحی یک مدل کوچک و تخصصی (با تنها ۱۴۶ میلیون پارامتر)، توانستهاند خطاهایی را شناسایی کنند که حتی داوران انسانی و مدلهای بزرگ «فرانتیر» در تشخیص آنها شکست میخورند.
این دستاورد نشان میدهد که برای ارزیابی «وفاداری رفتاری» مدلهای هوش مصنوعی، بهجای تمرکز صرف بر مقیاس و بزرگی مدل، میتوان از ابزارهای هوشمندانه و هدفمند استفاده کرد. این یعنی راهی دقیقتر و سریعتر برای افزایش اعتماد به دنیای AI! 🚀
منبع: arXiv AI
