تا حالا فکر کردید که مدلهای هوش مصنوعی چطور و در چه مرحلهای به یک پاسخ «متعهد» میشوند و چرا گاهی نمیتوانند آن را اصلاح کنند؟ 🤖
محققان در پژوهش جدیدی، مفهومی به نام «Prolepsis» را معرفی کردهاند که نشان میدهد ترنسفورمرها چطور خیلی زود تصمیم میگیرند و با استفاده از لایههای خاص، این تصمیم را تا انتها حفظ میکنند.
نکته جالب اینجاست که این تیم با آزمایش روی مدلهای سبکی مثل Llama 3.2 1B و Gemma 2 2B، متوجه شدند که فرآیند «برنامهریزی» در این مدلها کاملاً قابل رهگیری است و حتی با منابع محدود (یک کارت گرافیک معمولی) قابل مطالعه است.
این یافتهها به ما کمک میکند تا دقیقتر بفهمیم در «جعبه سیاه» مدلهای زبانی چه میگذرد و چرا گاهی شاهد رفتارهای غیرقابلتغییر از آنها هستیم.
منبع: arXiv AI
