یکی از چالشهای بزرگ در استفاده از روش «زنجیره تفکر» (CoT) در مدلهای هوش مصنوعی، ناپایداری و پاسخهای متناقض در مسائل پیچیده است. محققان به تازگی چارچوب جدیدی به نام CAP-CoT را معرفی کردهاند که با استفاده از یک رویکرد «چرخه تقابلی»، این مشکل را حل میکند.
در این روش، یک عامل هوشمند نقش «مبارز» را بازی میکند و با ایجاد چالشهای منطقی و خطاهای هدفمند، نقاط ضعف استدلال مدل را شناسایی میکند. این چرخه بازخورد باعث میشود مدل به مرور یاد بگیرد دقیقتر و پایدارتر استدلال کند. این پیشرفت میتواند گامی مهم برای استفاده از مدلهای زبانی در حل مسائل منطقی و علمی حساس باشد.
منبع: arXiv AI
