محققان در یک پژوهش جدید، توانایی مدلهای زبانی در «تراز کردن وظایف» (Task Alignment) را به چالش کشیدهاند. نتایج نشان میدهد که هوش مصنوعی در مواجهه با درخواستهای ناقص یا مبهم کاربران، اغلب زودتر از موعد دست به کار میشود و در رسیدن به هدف اصلی، عملکرد ضعیفتری نسبت به انسان دارد.
در حالی که مدلهای فعلی در وظایف مشخص عالی هستند، اما در تعاملات واقعی و حل ابهام، تنها ۲۲ تا ۳۲ درصد موفق عمل میکنند؛ این در حالی است که انسانها در همان شرایط به نرخ موفقیت ۴۸ درصدی میرسند. این پژوهش تاکید میکند که برای رسیدن به یک دستیار هوشمند و قابلاعتماد، مدلهای آینده باید قدرت استدلال و پرسشگری خود را در موقعیتهای نامشخص تقویت کنند.
آیا شما هم حس کردهاید که گاهی مدلهای زبانی قبل از اینکه منظور دقیق شما را بفهمند، شروع به پاسخگویی میکنند؟
منبع: arXiv AI
