محققان محیط جدیدی به نام «ZendoWorld» را معرفی کردهاند تا توانایی استدلال منطقی و حل مسائل در هوش مصنوعی را به چالش بکشند. نتایج جالب توجه است:
۱. دقت بالا در حدس زدن برچسبها لزوماً به معنای درکِ قوانین بازی نیست.
۲. مدلهای زبانی (VLM) در طراحی آزمایشهای هوشمند برای یادگیری قوانین جدید، همچنان ضعیف عمل میکنند.
۳. هنوز شکاف بزرگی بین استدلال انسانی و هوش مصنوعی در محیطهای تعاملی وجود دارد.
این تحقیق نشان میدهد که برای رسیدن به «هوش مصنوعی علمی»، صرفاً آموزش دیدن روی دادهها کافی نیست و مدلها باید یاد بگیرند چطور مثل دانشمندان، فرضیهسازی و آزمایش کنند. 🧪✨
منبع: arXiv Computer Vision
