مدلهای زبانی (LLM) در ظاهر خیلی باهوش به نظر میرسند، اما وقتی پای کارهای مرحلهبهمرحله یا استفاده از ابزارها وسط میآید، اغلب دچار مشکل میشوند. در یک پژوهش جامع جدید، ۲۷ مقاله علمی معتبر تحلیل شده تا دلایل شکست «عاملهای هوش مصنوعی» (AI Agents) در دنیای واقعی مشخص شود.
این مطالعه برای اولین بار، تمام خطاهای این مدلها را در دستهبندیهای مشخصی جمعآوری کرده؛ از اشتباه در استفاده از ابزارها و برنامهریزی گرفته تا چالشهای مربوط به حافظه در پروژههای طولانیمدت.
این دستاورد نشان میدهد که افزایش قدرت مدلها به تنهایی کافی نیست و باید راهکارهای دقیقتری برای جلوگیری از شکستهای زنجیرهای آنها طراحی کنیم. راهی طولانی اما هیجانانگیز تا هوش مصنوعی کاملاً قابلاعتماد!
منبع: arXiv AI
