🧠 ارائه یک طبقه‌بندی جامع برای توانمندی‌های مدل‌های زبانی (LLM)

🧠 چرا هوش مصنوعی گاهی «خیالات» می‌بیند؟

محققان در یک پژوهش تازه، به جای تمرکز بر وظایف پراکنده، یک ساختار چندلایه برای ارزیابی قابلیت‌های مدل‌های هوش مصنوعی طراحی کرده‌اند. این طبقه‌بندی که شامل ۱۴ دامنه و ۹۱ زیرشاخه مهارتی است، بر اساس علوم شناختی انسان تنظیم شده تا تصویر دقیق‌تری از توانایی‌های مدل‌ها مانند استدلال، برنامه‌ریزی و تعاملات اجتماعی ارائه دهد.

نتایج این بررسی روی بیش از ۱۵ هزار مقاله علمی نشان می‌دهد که تمرکز اصلی تحقیقات فعلی بر حوزه‌های «درک زبان» و «استدلال» است، در حالی که بسیاری از حوزه‌های دیگر هنوز جای کار زیادی دارند. این دسته‌بندی جدید می‌تواند به توسعه‌دهندگان کمک کند تا شکاف‌های موجود در عملکرد هوش مصنوعی را بهتر شناسایی کنند. 🚀

منبع: arXiv AI