محققان در یک پیشرفت جدید، مدل «LatentMT» را معرفی کردند که دنیای ترجمه ماشینی را متحول میکند! برخلاف مدلهای غولآسا که فقط پارامترهایشان را بیشتر میکنند، LatentMT با استفاده از «استدلال نهفته» (Latent Reasoning) در حالتهای پنهان مدل، با یک ساختار سبک (۲.۶ میلیارد پارامتری) عملکردی مشابه مدلهای ۳ تا ۵ برابر بزرگتر ارائه میدهد.
این مدل که در ترجمه زبانهای کممنابع و متوسط به عملکرد SOTA (بهترین سطح موجود) دست یافته، ثابت میکند که جایگزینی برای بزرگسازیِ محض مدلها پیدا شده است: استفاده هوشمندانه از توان پردازشی تکرار شونده! 🧠✨
منبع: arXiv AI
