محققان در یک پژوهش تازه، به جای تمرکز بر وظایف پراکنده، یک ساختار چندلایه برای ارزیابی قابلیتهای مدلهای هوش مصنوعی طراحی کردهاند. این طبقهبندی که شامل ۱۴ دامنه و ۹۱ زیرشاخه مهارتی است، بر اساس علوم شناختی انسان تنظیم شده تا تصویر دقیقتری از تواناییهای مدلها مانند استدلال، برنامهریزی و تعاملات اجتماعی ارائه دهد.
نتایج این بررسی روی بیش از ۱۵ هزار مقاله علمی نشان میدهد که تمرکز اصلی تحقیقات فعلی بر حوزههای «درک زبان» و «استدلال» است، در حالی که بسیاری از حوزههای دیگر هنوز جای کار زیادی دارند. این دستهبندی جدید میتواند به توسعهدهندگان کمک کند تا شکافهای موجود در عملکرد هوش مصنوعی را بهتر شناسایی کنند. 🚀
منبع: arXiv AI
