🧪 ارتقای تست نرم‌افزارهای علمی با هوش مصنوعی؛ معرفی معیار جدید SMS

⚠️ هشدار به محققان: چرا دقت مدل‌های شناسایی پهپاد گاهی «واقعی» نیست؟

تست کردن برنامه‌های محاسبات علمی همیشه چالش‌برانگیز بوده، چون روش‌های سنتی (Mutation Testing) بیشتر روی ساختار کد تمرکز دارند تا معنای علمی آن. حالا محققان روش جدیدی به نام «امتیاز جهش معنایی» (SMS) معرفی کرده‌اند.

این روش با استفاده از ۵ اپراتور معنایی (مانند تغییر هایپرپارامترها یا معکوس کردن مسیرها)، به هوش مصنوعی اجازه می‌دهد خطاهای واقعی علمی را از خطاهای ناشی از داده‌های پرت یا آرتیفکت‌ها تشخیص دهد. این پیشرفت گام بزرگی برای افزایش دقت و قابلیت اطمینان در نرم‌افزارهایی است که در حوزه‌های حساس محاسباتی استفاده می‌شوند. 🚀

منبع: arXiv Machine Learning