محققان تکنولوژی جدیدی به نام «TF-Engram» معرفی کردهاند که مشکل هزینههای سنگین آموزش و بهروزرسانی مدلهای زبانی بزرگ (LLM) را هدف قرار داده است.
این سیستم به جای اینکه دانش جدید را داخل خودِ پارامترهای مدل تزریق کند (که بسیار پرهزینه است)، از یک حافظه جانبی روی SSD استفاده میکند. به این ترتیب، مدل میتواند بدون نیاز به آموزش مجدد (Train-free)، به حجم عظیمی از دادهها دسترسی داشته باشد.
ویژگیهای کلیدی:
🔹 استفاده از سلسلهمراتب حافظه (GPU-DRAM-SSD) برای کاهش فشار بر حافظه گرافیکی.
🔹 کاهش چشمگیر هزینههای سختافزاری برای اجرای مدلها.
🔹 افزایش دقت مدلها با استفاده از حافظه معناییِ phrase-level.
این نوآوری راه را برای ساخت LLMهایی باز میکند که با منابع سختافزاری کمتر، هوشمندتر و بهروزتر عمل میکنند.
منبع: arXiv Machine Learning
