تا به حال دقت کردید که مدلهای هوش مصنوعی برای پاسخ به سوالات ساده هم از روشهای پیچیده استدلالی (مثل Chain-of-Thought) استفاده میکنند؟ این کار باعث هدر رفتن توان پردازشی و افزایش زمان انتظار میشود! ⏳
محققان در مقاله جدیدی، فریمورک «AutoThinkSQL» را معرفی کردند که به مدل یاد میدهد چه زمانی واقعاً نیاز به تفکر عمیق دارد و چه زمانی میتواند مستقیم به سراغ پاسخ برود. نتیجه؟
✅ کاهش ۲۴ درصدی تعداد توکنهای تولیدی
✅ کاهش ۱۷ درصدی در زمان پاسخدهی (Latency)
✅ حفظ دقت بالا در بنچمارکهای مهمی مثل Spider و BIRD
این یعنی مدلهای زبانی در آینده نه تنها باهوشتر، بلکه بسیار سریعتر و اقتصادیتر خواهند بود! ⚡️
نویسی
منبع: arXiv NLP



