🧠 چالش جدید برای هوش مصنوعی: آیا مدل‌ها واقعاً «استدلال» می‌کنند؟

⚠️ هشدار به محققان: چرا دقت مدل‌های شناسایی پهپاد گاهی «واقعی» نیست؟

محققان محیط جدیدی به نام «ZendoWorld» را معرفی کرده‌اند تا توانایی استدلال منطقی و حل مسائل در هوش مصنوعی را به چالش بکشند. نتایج جالب توجه است:

۱. دقت بالا در حدس زدن برچسب‌ها لزوماً به معنای درکِ قوانین بازی نیست.
۲. مدل‌های زبانی (VLM) در طراحی آزمایش‌های هوشمند برای یادگیری قوانین جدید، همچنان ضعیف عمل می‌کنند.
۳. هنوز شکاف بزرگی بین استدلال انسانی و هوش مصنوعی در محیط‌های تعاملی وجود دارد.

این تحقیق نشان می‌دهد که برای رسیدن به «هوش مصنوعی علمی»، صرفاً آموزش دیدن روی داده‌ها کافی نیست و مدل‌ها باید یاد بگیرند چطور مثل دانشمندان، فرضیه‌سازی و آزمایش کنند. 🧪✨

منبع: arXiv Computer Vision