محققان در مطالعه جدیدی به بررسی روشهای «مسیریابی پرسشهای محافظتشده» (Guarded Query Routing) پرداختند تا ببینند آیا مدلهای زبانی کوچک (SLM) میتوانند در عین حفظ سرعت بالا، پرسشهای نامرتبط یا ناامن را تشخیص دهند یا خیر. 🤖
نکته هیجانانگیز ماجرا اینجاست: بسیاری از مدلهای کوچک که در ابتدا عملکرد ضعیفی داشتند، با استفاده از تکنیکهای «بهینهسازی پرامپت» (Prompt Optimization) و بدون نیاز به تغییر در ساختار سنگین مدل، جهش چشمگیری در دقت پیدا کردند! مثلاً مدل Qwen3.5 9B با این روش توانست به عملکردی بسیار نزدیک به مدلهای غولپیکر برسد. ✅
این یعنی در آیندهای نزدیک، برای اجرای هوش مصنوعیهای هوشمند در گوشی یا لپتاپ شخصیتان، لزوماً به سختافزارهای بسیار قدرتمند نیاز نخواهید داشت و هنرِ درست پرسیدن (Prompt Engineering)، حرف اول را میزند!
منبع: arXiv NLP
