🚀 بهبود چشمگیر پیش‌بینی مدل‌های زبانی با متد نوآورانه Perturbation

⚠️ هشدار به محققان: چرا دقت مدل‌های شناسایی پهپاد گاهی «واقعی» نیست؟

آیا مدل‌های زبانی می‌توانند فراتر از داده‌های آموزشی خود عمل کنند؟ محققان به تازگی روش جدیدی را معرفی کرده‌اند که با استفاده از «نویزهای کنترل‌شده» (Perturbation)، توانایی مدل‌های زبانی را در پیش‌بینی دقیق‌تر متون خارج از محدوده آموزشی (Extrapolation) به شدت افزایش می‌دهد.

در این روش، به جای تکیه صرف بر پیش‌بینی کلمه بعدی بر اساس پیش‌فرض‌های دقیق، ورودی کمی تغییر یافته تا مدل با درک عمیق‌تری از ساختار معنایی، نتایج قابل‌اطمینان‌تری ارائه دهد. این رویکرد به مدل کمک می‌کند در سناریوهای جدید و ناشناخته، هوشمندتر عمل کند. 🧠✨

منبع: arXiv Machine Learning