تا امروز اکثر بنچمارکهای هوش مصنوعی روی زبانهای پرکاربرد مثل انگلیسی و چینی متمرکز بودند، اما محققان در پروژه جدید «PluraMath» این بازی را تغییر دادهاند! 🌏
این دیتاست جدید شامل ۱۸ زبان کمبرخوردار و متنوع است که به محققان کمک میکند توانایی استدلال ریاضی مدلهای زبانی (LLM) را در شرایط زبانی مختلف بسنجند. نتایج اولیه نشان میدهد که هنوز شکاف بزرگی بین توانایی مدلها در زبانهای اصلی و زبانهای کممنابع وجود دارد. با این کار، مسیر برای توسعه هوش مصنوعی فراگیرتر و عادلانهتر هموارتر شد. 🚀
منبع: arXiv:2607.05992
منبع: arXiv AI
