محققان چارچوب جدیدی به نام «LUMI» معرفی کردهاند که دنیای فشردهسازی تصاویر را متحول میکند. این مدل برخلاف روشهای قبلی، به توکنایزر خاصی وابسته نیست و با استفاده از مدلهای زبانی بزرگ (LLM) مثل LLaMA یا Qwen، تصاویر را بدون افت کیفیت (Lossless) فشردهسازی میکند.
💡 نکته جذاب اینجاست که LUMI به جای تبدیل پیکسلها به متن، آنها را مستقیماً به فضای نهفته (Embedding) مدل وارد میکند که باعث افزایش چشمگیر سرعت و دقت در حوزههای مختلف مثل تصاویر پزشکی و ماهوارهای شده است.
منبع: arXiv Computer Vision
