محققان در یک پژوهش جدید، روشی به نام «Concept Chaining» را معرفی کردند که نشان میدهد چگونه میتوان با استفاده از متنهای معمولی و پیوند دادن مفاهیم، مدلهای زبانی (LLM) را به سمت پاسخهای خاص هدایت کرد. این دستاورد ثابت میکند که مدلهای هوش مصنوعی علیرغم توانمندی بالا، در لایههای پنهان خود دارای شکنندگیهای منطقی هستند که میتواند منجر به سوگیریهای ناخواسته شود. این تحقیق زنگ خطری برای امنیت و دقت خروجیهای هوش مصنوعی در محیطهای حساس است! 🧐🛡️
منبع: arXiv NLP
