📸 فشرده‌سازی بی‌نقص تصاویر با قدرت مدل‌های زبانی (LLM)!

⚠️ هشدار به محققان: چرا دقت مدل‌های شناسایی پهپاد گاهی «واقعی» نیست؟

محققان چارچوب جدیدی به نام «LUMI» معرفی کرده‌اند که دنیای فشرده‌سازی تصاویر را متحول می‌کند. این مدل برخلاف روش‌های قبلی، به توکنایزر خاصی وابسته نیست و با استفاده از مدل‌های زبانی بزرگ (LLM) مثل LLaMA یا Qwen، تصاویر را بدون افت کیفیت (Lossless) فشرده‌سازی می‌کند.

💡 نکته جذاب اینجاست که LUMI به جای تبدیل پیکسل‌ها به متن، آن‌ها را مستقیماً به فضای نهفته (Embedding) مدل وارد می‌کند که باعث افزایش چشمگیر سرعت و دقت در حوزه‌های مختلف مثل تصاویر پزشکی و ماهواره‌ای شده است.

منبع: arXiv Computer Vision