🧠 ابزاری جدید برای سنجش هوش مصنوعی در معماری کامپیوتر: معرفی QuArch

🧠 چرا هوش مصنوعی گاهی «خیالات» می‌بیند؟

محققان به‌تازگی بنچمارک جدیدی به نام «QuArch» را معرفی کرده‌اند که به طور اختصاصی برای ارزیابی توانایی مدل‌های زبانی بزرگ (LLM) در حوزه تخصصی «معماری کامپیوتر» طراحی شده است. 🖥️

تا پیش از این، اکثر بنچمارک‌ها جنبه‌های عمومی مدل‌ها را می‌سنجیدند، اما QuArch با داشتن ۲۶۷۱ پرسش و پاسخ تخصصی در زمینه‌هایی مثل طراحی پردازنده، سیستم‌های حافظه و شبکه‌های اتصالی، شکاف‌های دانش و استدلال مدل‌های قدرتمند فعلی را آشکار می‌کند. جالب اینکه این تحقیق نشان می‌دهد با استفاده از این داده‌ها، مدل‌ها می‌توانند در طراحی‌های بهینه حافظه تا ۲ برابر بهره‌وری بیشتری داشته باشند! 🚀

این قدم بزرگی برای به کارگیری هوش مصنوعی در حل مسائل پیچیده مهندسی سخت‌افزار است.

منبع: arXiv AI