محققان در مقاله جدیدی روشی نوآورانه به نام DAPRO را معرفی کردهاند که به طور خاص برای ارزیابی مدلهای زبانی بزرگ (LLM) در گفتگوهای چند مرحلهای طراحی شده است.
🔹 چرا این موضوع مهم است؟
ارزیابی امنیت و کارایی مدلها (مثلاً تشخیص اینکه چه زمانی یک مدل دچار Jailbreak میشود)، فرآیندی هزینهبر و طولانی است. DAPRO با تخصیص پویای بودجه محاسباتی، به محققان کمک میکند تا بدون هدر دادن منابع، دقت بالایی در پیشبینی زمان وقوع رویدادها (Time-to-Event) در تعاملات چند مرحلهای داشته باشند. این روش نه تنها بهینهتر از متدهای قبلی است، بلکه تضمینهای آماری دقیقتری نیز ارائه میدهد.
این پیشرفت گام بزرگی برای تست امنیت و سلامت رفتاری مدلهای هوش مصنوعی در محیطهای واقعی است. 🚀
منبع: arXiv Machine Learning
