آیا مدلهای زبانی کوچک (MSLMs) واقعاً برای استفاده در کارخانههای هوشمند و سیستمهای حساس آمادهاند؟ محققان در پژوهش جدیدی بنام RobustMAD، اولین بنچمارک اختصاصی برای بررسی «واقعی» این مدلها در محیطهای صنعتی را معرفی کردهاند.
نتایج این تحقیق نکات جالبی را روشن میکند:
✅ مدلهای زبانی کوچک ثابت کردند که در برخی حوزهها حتی از رقبای بزرگتر خود (مثل GPT-5 Nano) پیشی میگیرند.
⚠️ با این حال، هنوز در شرایط عملیاتی با سه چالش بزرگ مواجه هستند: ضعف در تشخیص جزئیات دقیق، ناتوانی در پاسخدهی جامع، و مهمتر از همه، «توهم» در مواجهه با پرسشهای نامفهوم که ریسکهای امنیتی ایجاد میکند.
این تحقیق گامی مهم برای ایمنتر کردن بازوهای بینایی و هوش مصنوعی در محیطهای تولیدی است که دقت در آنها حیاتی است.
منبع: arXiv AI
