🚀 پیش‌بینی قدرت مدل‌های هوش مصنوعی قبل از آموزش نهایی!

🧠 چرا هوش مصنوعی گاهی «خیالات» می‌بیند؟

محققان در مطالعه‌ای جدید، روشی نوآورانه برای «قوانین مقیاس‌پذیری» (Scaling Laws) در فیزیک ذرات ارائه کرده‌اند. تا پیش از این، هزینه بالای آموزش مدل‌های بزرگ باعث می‌شد ندانیم خروجی نهایی چقدر دقیق خواهد بود. اما حالا با یک فرمول جدید، می‌توان عملکرد مدل‌های پیچیده در فیزیک ذرات را تنها با بررسی مدل‌های کوچک‌تر، با دقت بسیار بالا پیش‌بینی کرد!

این یعنی بهینه‌سازی بودجه‌های پردازشی و جلوگیری از هدر رفتن منابع در آموزش مدل‌های سنگین. تیم تحقیق، کدهای این مدل‌ها را نیز برای استفاده جامعه علمی منتشر کرده‌اند.

منبع: arXiv AI