محققان به تازگی روش نوآورانهای به نام «کوانتیزاسیون هندسی یادگیرنده» (Learnable Geometric Quantization) یا همان LGQ معرفی کردهاند که تحولی در توکنسازی تصاویر ایجاد میکند. برخلاف روشهای قبلی که از شبکههای ثابت استفاده میکردند، LGQ با بهرهگیری از یک کدبوک منعطف، بدون نیاز به تنظیمات پیچیده، کیفیت بازسازی تصویر و تولید محتوای بصری را به شکل چشمگیری افزایش میدهد.
این متد که به راحتی با مدلهایی مثل MaskGIT ادغام میشود، ثابت کرده که هم در دقت بازسازی و هم در تولید تصاویر مشروط به کلاس، عملکرد خیرهکنندهای دارد. خبر خوب اینکه کدهای این دستاورد هم برای علاقهمندان در دسترس قرار گرفته است.
منبع: arXiv Computer Vision
