محققان در دستاوردی جدید، مدل انقلابی «Omni-Diffusion» را معرفی کردند که دنیای مدلهای زبانی را تکان داده است! برخلاف مدلهای فعلی که بیشتر بر معماریهای خودرگرسیو (Autoregressive) تکیه دارند، این مدل از «دیفیوژنهای گسسته مبتنی بر ماسک» استفاده میکند.
چه چیزی این مدل را خاص میکند؟
✅ پشتیبانی کامل از هر نوع داده (متن، صوت و تصویر).
✅ یکپارچهسازی کامل درک و تولید محتوا در یک ساختار واحد.
✅ عملکردی فراتر از سیستمهای فعلی در انجام وظایف چندوجهی پیچیده.
این مدل نشان میدهد که تکنولوژی دیفیوژن چقدر در مدلهای پایه آینده نقش پررنگی خواهد داشت. برای مشاهده جزئیات بیشتر میتوانید به وبسایت پروژه سر بزنید.
منبع: arXiv Computer Vision
