محققان در مطالعهای جدید، عملکرد مدلهای زبانی بزرگ (مثل GPT-4o، Gemini و Llama) را در شناسایی خطرات فیزیکیِ چندگانه بررسی کردند. نتیجه تکاندهنده است: این مدلها اگرچه در تشخیص خطرات تکسنسوری عالی عمل میکنند، اما وقتی با ترکیبی از سنسورها مواجه میشوند که نشاندهنده یک خطر بزرگ است، کاملاً «نابینا» میشوند و هیچ هشدار پیشگیرانهای صادر نمیکنند! ⚠️
این تحقیق هشدار میدهد که استفاده از مدلهای فعلی در سیستمهای نظارتی حیاتی (مثل پالایشگاهها یا کارخانههای حساس) بدون نظارت انسانی، میتواند بسیار خطرناک باشد. مدلها در استدلالِ همزمانِ دادههای چندسنسوری همچنان ضعف بزرگی دارند که باید جدی گرفته شود. 🤖📉
منبع: arXiv AI
