آیا آموزش مدلهای عظیم تولید تصویر (Diffusion Models) برایتان کند و پرهزینه است؟ محققان بهتازگی فریمورک جدیدی به نام FourTune را معرفی کردهاند که دنیای «Fine-tuning» را متحول میکند.
این متد با استفاده از معماری هوشمند W4A4G4 و ترکیب آن با LoRA، اجازه میدهد مدلهای غولپیکری مثل FLUX.1 (با ۱۲ میلیارد پارامتر) را با دقت بالا و در عین حال مصرف حافظه و زمان بسیار کمتر آموزش دهید.
✨ برخی از ویژگیهای کلیدی FourTune:
✅ کاهش ۲.۲۵ برابری هزینههای حافظه
✅ افزایش بیش از ۲ برابری سرعت آموزش
✅ پایداری بسیار بالا در محاسبات ۴ بیتی
با این روش، دیگر برای داشتن مدلهای شخصیسازی شده و حرفهای نیازی به سختافزارهای فوقسنگین ندارید!
منبع: arXiv Computer Vision
