با ورود هوش مصنوعی به دنیای پیچیده تحقیقات زیستی، نگرانیها درباره استفاده نادرست از این فناوری افزایش یافته است. محققان به تازگی بنچمارک جدیدی به نام «BioSecBench-Refusal» معرفی کردهاند تا ارزیابی کنند که مدلهای هوش مصنوعی تا چه حد میتوانند بین «تحقیقات علمی مشروع» و «خطرات امنیتی» تفاوت قائل شوند.
نتایج این تحقیق نشان میدهد که بسیاری از مدلها هنوز در تشخیص مرز دقیق این دو دچار مشکل هستند؛ به طوری که گاهی پروژههای عادی و تحقیقاتی را به اشتباه مسدود میکنند و گاهی در شناسایی خطرات واقعی ناتواناند. این دستاورد گام مهمی است تا توسعهدهندگان بتوانند هوش مصنوعی را برای کارهای آزمایشگاهی بهینهتر و البته ایمنتر کنند. 🧬🤖
منبع: arXiv AI
