محققان در مطالعه اخیر خود روی مدلهای پیشآموزشدیده چندوجهی (Multi-View Pretraining)، به یک محدودیت بنیادی و ساختاری در سیستمهای هوشمند دست یافتهاند. 🧠
نکته کلیدی این مقاله این است که گاهی اوقات، پاسخ یک پرسش، حتی با داشتن دادههای بسیار زیاد هم قابل استخراج نیست! این مشکل نه به خاطر کمبود حجم داده، بلکه به دلیل طراحی «واسطهای کاربری» یا همان نحوه اتصال دادههاست که اصطلاحاً «ابهام ساختاری» ایجاد میکند.
تیم تحقیقاتی با ارائه دو الگوریتم جدید (CheckCert و Greedy-MinAug)، راهکارهایی برای شناسایی این ابهامات و بهینهسازی سیستمهای یکپارچهسازی داده ارائه دادهاند تا دقت مدلها در برابر این «کف خطای غیرقابلکاهش» ارتقا یابد. این تحقیق گام مهمی در درک بهتر محدودیتهای ریاضی مدلهای پیشرفته است.
منبع: arXiv Machine Learning
