مدلهای نفوذِ ماسکشده (MDMs) یکی از ابزارهای قدرتمند در تولید زبان هستند، اما تولیدِ باکیفیت و سریع (Few-step) همواره چالشبرانگیز بوده است. حالا محققان مدل جدیدی به نام «MultiMDM» معرفی کردهاند که با استفاده از ساختار «چند ماسکه»، اجازه میدهد فرآیند تولید متن بسیار بهینهتر و با دقت بالاتری نسبت به روشهای سنتی انجام شود. این نوآوری، راه را برای آموزش مداوم مدلهای زبانی و افزایش سرعت پاسخدهی آنها هموار میکند. 💡🧠
منبع: arXiv Machine Learning
