🚀 بهینه‌سازی دقیق‌تر مدل‌های زبانی: معرفی روش جدید LP-SFT

⚠️ هشدار به محققان: چرا دقت مدل‌های شناسایی پهپاد گاهی «واقعی» نیست؟

تا حالا دقت کردید وقتی مدل‌های هوش مصنوعی را برای کارهای خاص آموزش می‌دهیم (SFT)، گاهی توانایی‌های کلی‌شان ضعیف می‌شود؟ محققان در یک راهکار تازه، روشی به نام LP-SFT را معرفی کرده‌اند که این مشکل را حل می‌کند!

💡 این روش چه کار می‌کند؟
در آموزش‌های معمول، مدل ممکن است دانش قبلی خود را فراموش کند. اما در روش LP-SFT، با حفظ ساختار «آنتروپی» یا همان تنوع احتمالات در پیش‌بینی توکن‌ها، مدل یاد می‌گیرد بدون از دست دادن دانش عمومی‌اش، در حوزه‌های تخصصی هم بسیار دقیق‌تر عمل کند.

به زبان ساده، این تکنیک باعث می‌شود مدل هوشمندتر و پایدارتر باقی بماند و تعادل بهتری بین یادگیری وظیفه جدید و حفظ دانسته‌های قبلی برقرار کند.

منبع: arXiv Machine Learning