🔍 کشف مکانیزمِ تصمیم‌گیریِ مدل‌های زبانی: مفهوم جدید Prolepsis!

⚠️ هشدار به محققان: چرا دقت مدل‌های شناسایی پهپاد گاهی «واقعی» نیست؟

تا حالا فکر کردید که مدل‌های هوش مصنوعی چطور و در چه مرحله‌ای به یک پاسخ «متعهد» می‌شوند و چرا گاهی نمی‌توانند آن را اصلاح کنند؟ 🤖

محققان در پژوهش جدیدی، مفهومی به نام «Prolepsis» را معرفی کرده‌اند که نشان می‌دهد ترنسفورمرها چطور خیلی زود تصمیم می‌گیرند و با استفاده از لایه‌های خاص، این تصمیم را تا انتها حفظ می‌کنند.

نکته جالب اینجاست که این تیم با آزمایش روی مدل‌های سبکی مثل Llama 3.2 1B و Gemma 2 2B، متوجه شدند که فرآیند «برنامه‌ریزی» در این مدل‌ها کاملاً قابل رهگیری است و حتی با منابع محدود (یک کارت گرافیک معمولی) قابل مطالعه است.

این یافته‌ها به ما کمک می‌کند تا دقیق‌تر بفهمیم در «جعبه سیاه» مدل‌های زبانی چه می‌گذرد و چرا گاهی شاهد رفتارهای غیرقابل‌تغییر از آن‌ها هستیم.

منبع: arXiv AI