آیا مدلهای زبانی بزرگ برای رسیدن به پاسخ، بیش از حد «درجا» میزنند؟ محققان با ارائه روش جدید BIRD (مخفف Bootstrapped Iterative Self-Reasoning Distillation)، راهکار هوشمندانهای برای حذف محاسبات تکراری و مسیرهای انحرافی در مدلهای استدلالی پیدا کردهاند.
این روش دو مرحلهای، ابتدا با آموزش «کوتاهنویسی» به مدل، آن را به سمت استدلالهای دقیقتر و بدون حاشیه هدایت میکند و سپس با استفاده از تقطیر دانش (Distillation) به صورت خودکار، کیفیت خروجی را به شدت افزایش میدهد. این یعنی هوش مصنوعی که نه تنها دقیقتر است، بلکه سریعتر و بهینهتر هم فکر میکند! 🎯
منبع: arXiv NLP
