مدلهای بینایی-زبانی (VLMs) در حل مسائل بصری عالی هستند، اما در رعایت قواعد منطقیِ دقیق اغلب دچار اشتباه میشوند. محققان در پژوهشی جدید، یک راهکار خلاقانه ارائه دادهاند: ترکیب هوش مصنوعی با الگوریتمهای «MaxSAT» (بیشینهسازی رضایتمندی).
در این روش، مدل به تنهایی حدس نمیزند؛ بلکه یک موتور منطقی در پسزمینه، خروجیهای مدل را به عنوان قواعد سودوکو بررسی میکند. اگر خطایی در چیدمان اعداد رخ دهد، این موتور با ارائه بازخورد، مدل را وادار به اصلاح مسیر میکند.
این یعنی هوش مصنوعی حالا میتواند با کمک استدلال نمادین، در کارهای ساختاریافته مثل حل معماها بسیار دقیقتر و قابلاعتمادتر عمل کند! 🤖✨
منبع: arXiv AI
