محققان در پژوهشی تازه نشان دادهاند که برای رسیدن به مدلهای چندوجهی دقیقتر (مثل مدلهای تصویر-متن)، فقط تغییر توابع هدف کافی نیست! آنها متوجه شدند که «شرطیسازی ژاکوبی» در انکودرها نقش حیاتی در جلوگیری از فروپاشی مدلها و بهبود همترازی چندوجهی دارد.
با معرفی انکودرهای «حفظکننده هندسه» (GPEs) و اصلاحات سادهای مثل استفاده از LeakyReLU، حالا مدلها در بنچمارکهای مختلف عملکرد بسیار بهتری در استخراج ویژگیها و یادگیری دارند. انگار هوش مصنوعی برای درک بهتر دنیای چندوجهی، به هندسهای دقیقتر نیاز دارد! 🧠✨
منبع: arXiv AI
