محققان به تازگی راهکار نوآورانهای ارائه کردهاند که به مدلهای زبانی (LLMs) اجازه میدهد بدون نیاز به آموزش مجدد (Retraining)، کدهای پیچیده MLIR را با دقت بسیار بالا تولید کنند.
نکته کلیدی این دستاورد:
🔹 این روش با استفاده از استخراج خودکارِ قوانین ساختاری از مشخصاتِ Dialectها، محدودیتهای هوشمندی برای دیکود کردن (Decoding) ایجاد میکند.
🔹 نتیجه؟ مدلهای کوچکتر (مثل SmolLM2-1.7B) توانستهاند در تولید کد MLIR، عملکردی مشابه مدلهای غولپیکر 34 میلیاردی داشته باشند و سرعت تولید را تا ۲۵ برابر افزایش دهند! ⚡️
این پیشرفت میتواند مسیر توسعه کامپایلرهای هوش مصنوعی و زیرساختهای پردازشی را بسیار هموارتر کند.
نویسی
منبع: arXiv AI
