محققان در دنیای هوش مصنوعی، مدل جدیدی به نام «Mage-Flow» معرفی کردند که با وجود ابعاد فشرده (۴ میلیارد پارامتر)، عملکردی فوقالعاده در تولید و ویرایش متنبهتصویر دارد.
نکات کلیدی این دستاورد:
🔹 بهرهوری بالا: افزایش ۲.۵ برابری سرعت آموزش به لطف بهینهسازیهای جدید.
🔹 پردازش Native: حفظ کیفیت اصلی تصاویر بدون افت کیفیت در ابعاد مختلف.
🔹 مدلهای Turbo: امکان تولید و ویرایش تصویر با تأخیر بسیار کم (Low-latency) که آن را برای کاربردهای بلادرنگ ایدهآل میکند.
🔹 ویرایش دقیق: قابلیت اجرای دستورات متنی برای ویرایش تصاویر با دقت بسیار بالا.
این مدل نشان میدهد که برای داشتن هوش مصنوعی قدرتمند، همیشه نیاز به مدلهای عظیمالجثه نیست و با معماری هوشمندانه میتوان به نتایج رقابتی دست یافت.
منبع: arXiv AI
