🧠 آیا هوش مصنوعی در درک درخواست‌های مبهم ما شکست می‌خورد؟

⚠️ هشدار به محققان: چرا دقت مدل‌های شناسایی پهپاد گاهی «واقعی» نیست؟

محققان در یک پژوهش جدید، توانایی مدل‌های زبانی در «تراز کردن وظایف» (Task Alignment) را به چالش کشیده‌اند. نتایج نشان می‌دهد که هوش مصنوعی در مواجهه با درخواست‌های ناقص یا مبهم کاربران، اغلب زودتر از موعد دست به کار می‌شود و در رسیدن به هدف اصلی، عملکرد ضعیف‌تری نسبت به انسان دارد.

در حالی که مدل‌های فعلی در وظایف مشخص عالی هستند، اما در تعاملات واقعی و حل ابهام، تنها ۲۲ تا ۳۲ درصد موفق عمل می‌کنند؛ این در حالی است که انسان‌ها در همان شرایط به نرخ موفقیت ۴۸ درصدی می‌رسند. این پژوهش تاکید می‌کند که برای رسیدن به یک دستیار هوشمند و قابل‌اعتماد، مدل‌های آینده باید قدرت استدلال و پرسشگری خود را در موقعیت‌های نامشخص تقویت کنند.

آیا شما هم حس کرده‌اید که گاهی مدل‌های زبانی قبل از اینکه منظور دقیق شما را بفهمند، شروع به پاسخگویی می‌کنند؟

منبع: arXiv AI