مدلهای زبانی (LLMs) با وجود قدرت بالا، هنوز در حل مسائل پیچیدهی «برنامهریزی» (Planning) با چالشهای جدی روبرو هستند. اما محققان به تازگی راهکار هیجانانگیزی ارائه دادهاند!
🔹 معماری جدید Chain of Computation (COC) با استفاده از یک حلقهی تکرار شونده و یک «پنجره متن ساختاریافته» (SCW)، به مدلهای زبان اجازه میدهد مثل یک ماشین تورینگ عمل کنند.
نتایج این تحقیق نشان میدهد که با این روش، حتی مدلهای کوچک هم میتوانند در حل پازلهای دشوار و مسائل برنامهریزی، به دقت بالای ۹۹ درصد برسند. این یک گام بزرگ برای عبور از محدودیتهای استدلالی هوش مصنوعی است. 🤖✨
منبع: arXiv Machine Learning
