تا به حال فکر کردهاید که آیا مدلهای زبانی بزرگ (LLM) میتوانند در بازارهای رقابتی، مذاکرهکنندگان خوبی باشند؟ 🤔
پژوهش جدیدی منتشر شده که نشان میدهد مدلهای فعلی، با وجود قدرت زبانی بالا، در زمینه «مذاکره اقتصادی» نقصهایی دارند؛ به ویژه در زمانی که باید بین کاوش در بازار (پیدا کردن مشتری بهتر) و بستن قرارداد با مشتری فعلی تعادل برقرار کنند.
محققان با استفاده از روش «یادگیری تقویتی از پاداشهای قابلراستیآزمایی» (RLVR)، مدلی را آموزش دادهاند که میتواند استراتژیهای پیچیده معاملاتی را یاد بگیرد و مانند یک انسانِ حرفهای، بازار را تحلیل و بهترین سود را استخراج کند. این قدم بزرگی برای کاربردیتر شدن ایجنتهای هوش مصنوعی در دنیای تجارت است! 📈💼
منبع: arXiv Machine Learning
