🤖 کاهش خطای «فراخوانی ابزار» در مدل‌های ایجنتیک با روش جدید Soft Clamp

⚠️ هشدار به محققان: چرا دقت مدل‌های شناسایی پهپاد گاهی «واقعی» نیست؟

مدل‌های زبانی ایجنتیک (Agentic LLMs) برای اینکه درست کار کنند، باید دقیقا بدانند کی از ابزارها استفاده کنند و کی مستقیماً پاسخ دهند. اما در فرآیند آموزش با چندین معلم، مدل‌ها اغلب دچار «بیش‌فعالی در فراخوانی» (Over-calling) می‌شوند.

محققان برای حل این مشکل، تکنیک جدیدی به نام Soft Clamp را معرفی کرده‌اند که با تنظیم دقیق کالیبراسیون توکن‌ها، فراخوانی‌های اشتباه ابزار را تا حد زیادی کاهش می‌دهد، بدون اینکه دقت مدل در پاسخ‌دهی افت کند. این پیشرفت گامی مهم برای هوشمندتر و دقیق‌تر کردن دستیارهای هوش مصنوعی در محیط‌های کاری پیچیده است. ✨

منبع: arXiv Machine Learning