محققان در مقالهای جدید، چارچوب ابداعی به نام «Loopzero» را معرفی کردند. این ابزار به ما کمک میکند تا بفهمیم آیا سیستمهای هوش مصنوعی بازگشتی (Recursive Systems)، قبل از اینکه دچار خرابی و فروپاشی کامل شوند، نشانههایی از خود بروز میدهند یا خیر.
این تحقیق با بررسی الگوهای آماری، به دنبال کشف رفتارهای مشکوکی است که ممکن است به «فروپاشی بازگشتی» منجر شود؛ چیزی که پیشتر در مسیرهای آموزش LLMها نیز مشاهده شده بود. این دستاورد، گامی مهم برای افزایش امنیت و پایداری مدلهای هوش مصنوعی است تا بتوانیم قبل از وقوع فاجعه، جلوی شکستهای احتمالی را بگیریم.
منبع: arXiv Machine Learning
