محققان در مطالعهای جدید، بنچمارک ویژهای به نام «CLBench-V» را معرفی کردهاند که توانایی مدلهای هوش مصنوعی در یادگیری از «زمینه» (Context) را به چالش میکشد. برخلاف مدلهای قبلی که بیشتر بر متن تمرکز داشتند، این بنچمارک روی دادههای چندوجهی (Multimodal) مثل تصاویر علمی، نمودارهای مالی و نقشهها متمرکز است.
نتایج بررسی ۶ مدل هوش مصنوعی قدرتمند نشان میدهد که هنوز راه زیادی تا تسلط کامل مدلها بر یادگیری چندوجهی باقی مانده و امتیاز نهایی آنها هنوز پایین است. این ابزار به توسعهدهندگان کمک میکند تا نقاط ضعف مدلها در درک بصری و کاربرد دانش جدید را بهتر شناسایی کنند. مسیر هوش مصنوعی به سمت درک عمیقتر از دنیای پیرامون ما با سرعت ادامه دارد! 🚀
منبع: arXiv AI
