🧮 شکستن سد زبانی در استدلال ریاضی هوش مصنوعی با PluraMath

⚠️ هشدار به محققان: چرا دقت مدل‌های شناسایی پهپاد گاهی «واقعی» نیست؟

تا امروز اکثر بنچ‌مارک‌های هوش مصنوعی روی زبان‌های پرکاربرد مثل انگلیسی و چینی متمرکز بودند، اما محققان در پروژه جدید «PluraMath» این بازی را تغییر داده‌اند! 🌏

این دیتاست جدید شامل ۱۸ زبان کم‌برخوردار و متنوع است که به محققان کمک می‌کند توانایی استدلال ریاضی مدل‌های زبانی (LLM) را در شرایط زبانی مختلف بسنجند. نتایج اولیه نشان می‌دهد که هنوز شکاف بزرگی بین توانایی مدل‌ها در زبان‌های اصلی و زبان‌های کم‌منابع وجود دارد. با این کار، مسیر برای توسعه هوش مصنوعی فراگیرتر و عادلانه‌تر هموارتر شد. 🚀

منبع: arXiv:2607.05992

منبع: arXiv AI