محققان در یک پژوهش تازه، چارچوب جدیدی برای مدلهای انتشار گسسته ارائه دادهاند که مشکل قدیمی «وابستگی به ابعاد» را حل میکند. تا پیش از این، تحلیلهای ریاضی در مدلهای زبانی با دایره لغات بزرگ (صدها هزار توکن) به بنبست میخوردند، اما حالا با استفاده از «معادلات الحاقی» (Adjoint Equations)، میتوان بدون در نظر گرفتن اندازه فضای حالت، همگرایی مدلها را تضمین کرد.
این یعنی در آیندهای نزدیک، مدلهای مولد در حوزههای متن، تصویر و حتی زیستشناسی، دقیقتر و بهینهتر از همیشه عمل خواهند کرد. انقلابی در پایه و اساسِ ریاضی هوش مصنوعی که میتواند سرعت و دقت آموزش مدلهای نسل بعد را متحول کند! 🧠✨
منبع: arXiv Machine Learning
