محققان در یک پژوهش جدید، راهکار هوشمندانهای به نام ASK-NN را معرفی کردهاند که برای شناسایی «تغییرات توزیع» در خروجی مدلهای زبانی (LLMs) طراحی شده است.
این ابزار با استفاده از روش آماری «نزدیکترین همسایه نامتقارن»، میتواند تفاوتهای ظریف بین توزیع پرامپتها و پاسخهای مدل را تحلیل کند. این ویژگی به ویژه برای تشخیص خودکار «توهمات هوش مصنوعی» و متون تولید شده توسط ماشین بسیار کاربردی و دقیق است.
از ویژگیهای بارز این روش، سادگی پیادهسازی و کارایی بالا در مقایسه با روشهای قدیمیتر است که میتواند گام مهمی در جهت افزایش شفافیت و اعتماد به خروجیهای هوش مصنوعی باشد.
منبع: arXiv Machine Learning
