آیا مدلهای زبانی میتوانند فراتر از دادههای آموزشی خود عمل کنند؟ محققان به تازگی روش جدیدی را معرفی کردهاند که با استفاده از «نویزهای کنترلشده» (Perturbation)، توانایی مدلهای زبانی را در پیشبینی دقیقتر متون خارج از محدوده آموزشی (Extrapolation) به شدت افزایش میدهد.
در این روش، به جای تکیه صرف بر پیشبینی کلمه بعدی بر اساس پیشفرضهای دقیق، ورودی کمی تغییر یافته تا مدل با درک عمیقتری از ساختار معنایی، نتایج قابلاطمینانتری ارائه دهد. این رویکرد به مدل کمک میکند در سناریوهای جدید و ناشناخته، هوشمندتر عمل کند. 🧠✨
منبع: arXiv Machine Learning
