امروزه استفاده از مدلهای زبانی بزرگ (LLM) برای شبیهسازی رفتارهای انسانی در حوزههای مختلف مثل اقتصاد، سیاست و روانشناسی به شدت داغ شده است. اما خبر جدید این است که پژوهشگران معتقدند این شبیهسازیها هنوز تا «قابلاعتماد بودن» فاصله زیادی دارند!
در این مطالعه تازه، محققان نشان دادند که تفاوتهای فاحشی بین خروجی مدلها و رفتارهای واقعی انسان وجود دارد. آنها ضمن شناسایی ریشههای این ضعف در معماری مدلها و طراحی شبیهسازیها، راهکارهایی برای بهبود دادهها و الگوریتمهای طراحی پیشنهاد دادهاند تا در آینده شاهد شبیهسازیهای دقیقتر و انسانیتری باشیم.
اگر به جزئیات علمی و راهکارهای عملی این تحقیق علاقهمندید، میتوانید منابع و کدهای مربوط به این پروژه را در گیتهاب بررسی کنید.
منبع: arXiv NLP
