محققان در یک پژوهش جدید روی مدلهای زبانی (LLMs)، به نتیجه جالبی رسیدهاند: هوش مصنوعی برای یادگیری ساختارهای پیچیده زبانی (مانند ساختار «عطف» یا Coordination)، لزوماً نیازی به دیدنِ مستقیمِ این مثالها در دادههای آموزشی ندارد!
🔹 ماجرا چیست؟
تیم تحقیق با استفاده از تکنیک FiCT، تمام نمونههای «عطف نامشابه» را از دیتای آموزشی GPT-2 حذف کردند. نتیجه شگفتانگیز بود؛ مدل همچنان توانست این ساختارها را بهدرستی درک و تولید کند. این یعنی مدلهای زبانی فراتر از «حفظ کردن»، قدرت «تعمیمدهی» و درکِ ساختارهای پنهان زبانی را دارند.
این تحقیق گامی مهم برای درک بهتر نحوه پردازش زبان توسط مغزهای دیجیتالی ماست! 🚀
منبع: arXiv NLP
