محققان در مقاله جدید خود از چارچوب نوآورانهای به نام UnMaskFork (UMF) رونمایی کردند که برای «مدلهای زبانی انتشارِ ماسکشده» (MDLM) طراحی شده است. این روش با استفاده از تکنیک جستجوی درخت مونتکارلو (MCTS)، مسیر تولید متن را بهینه میکند.
ویژگی کلیدی این متد، استفاده از «زمان استنتاج» برای افزایش توانایی استدلال مدل است، درست همان کاری که پیشتر برای مدلهای زبانی خودبازگشت (Autoregressive) انجام میشد. نتایج نشان میدهد که UMF در بنچمارکهای پیچیده کدنویسی و مسائل ریاضی، عملکردی خیرهکننده و فراتر از مدلهای فعلی دارد. 💻📈
منبع: arXiv AI
