محققان در یک پژوهش جدید، فریمورک نوآورانهای به نام SuperGT معرفی کردهاند که دنیای طبقهبندی تصاویر را تغییر میدهد.
این مدل بهجای پردازش تکتک پیکسلهای سنگین و تکراری (که در CNNها و ViTها رایج است)، از «سوپرپیکسلها» و گرافها استفاده میکند. دستاورد بزرگ این تحقیق، حفظ ویژگیهای هندسی مثل تقارن و دوران (Invariance) در کنار درک وابستگیهای طولانیمدت در تصویر است که باعث میشود مدل در عین سرعت بالاتر، دقت بسیار خیرهکنندهای را تجربه کند. 🧠✨
این یعنی در آیندهای نزدیک، مدلهای هوش مصنوعی با مصرف توان پردازشی کمتر، دقت بسیار بالاتری در تحلیل تصاویر خواهند داشت.
منبع: arXiv Machine Learning
