آیا تا به حال به این فکر کردهاید که هوش مصنوعی چه زمانی میتواند بدون دخالت انسان، به صورت خودکار خودش را اصلاح و بهتر کند؟ در یک پژوهش جدید و بسیار جذاب که در arXiv منتشر شده، محققان به سراغ چالش «خوداصلاحی بازگشتی» در مدلهای زبانی (LLMs) رفتهاند.
نکته کلیدی این مقاله مفهوم «دروننگری» (Introspection) است. دانشمندان معتقدند برای اینکه مدلها بتوانند به طور پایدار و ایمن خود را بهبود دهند، باید ظرفیتی شبیه به خودآگاهی داشته باشند تا بتوانند عملیاتهای داخلی خود را شبیهسازی و اصلاح کنند. اگرچه مدلهای فعلی تا حدی قابلیتهای متا-شناختی دارند، اما به دلیل محدودیتهای ساختاری ترنسفورمرها، هنوز با «دروننگری واقعی» فاصله دارند.
این مقاله نقشه راهی برای عبور از این محدودیتها ارائه میدهد که میتواند آینده هوش مصنوعی خودمختار را متحول کند.
منبع: arXiv AI
