تا حالا شده بخواهید صحت یک ادعای علمی را با بررسی نمودارها و جداول پیچیده چک کنید و هوش مصنوعی در درک آنها دچار سردرگمی شود؟ 🤔
محققان به تازگی چارچوب هوشمند جدیدی به نام ToolSciVer را معرفی کردهاند که دنیای مدلهای زبانی-بینایی (VLM) را متحول میکند. این مدل با استفاده از ابزارهای تخصصی مثل زوم روی نمودارها و تحلیل ساختار جداول، به جای حدس زدن، مستقیماً به سراغ شواهد دقیق میرود.
ویژگیهای کلیدی این دستاورد:
🛠 بهرهگیری از ابزارهای نوعآگاه برای خوانش دقیق جداول و نمودارها.
🚀 استفاده از بهینهسازی سیاست گروهی (GRPO) برای بهبود استدلال و کارایی.
📊 عملکرد خیرهکننده روی مدلهای مطرحی مثل Qwen و InternVL در مقایسه با روشهای قدیمی.
این یعنی در آینده، هوش مصنوعی میتواند به عنوان یک دستیار پژوهشی بسیار دقیق، تمام دادههای بصری مقالات را در لحظه راستیآزمایی کند! 🎓
منبع: arXiv AI
