محققان مدل جدیدی به نام «LOGOS» را معرفی کردهاند که درک ما از تصاویر ماهوارهای و هوایی را متحول میکند. برخلاف روشهای سنتی که در تشخیص اشیاء چرخان یا در صحنههای شلوغ با چالش روبرو بودند، مدل LOGOS از دستورات متنی (Textual Prompts) برای هدایت تمرکز هوش مصنوعی استفاده میکند.
این روشِ مبتنی بر ترنسفورمر، با تنظیم داینامیک تمرکز مدل، دقت فوقالعادهای در تشخیص اشیاء در محیطهای پیچیده به دست آورده و گام بزرگی برای کاربردهایی مانند نقشهبرداری هوشمند و تحلیلهای جغرافیایی محسوب میشود. 🛰️✨
منبع: arXiv Computer Vision
