🔍 رمزگشایی از نحوه تصمیم‌گیری مدل‌های هوش مصنوعی!

🧠 چرا هوش مصنوعی گاهی «خیالات» می‌بیند؟

محققان به کشف جالبی در ساختار ترنسفورمرها (مثل Llama و Mistral) رسیدند: لایه‌ای به نام «لایه تصمیم سخت» (Hard Decision Layer) که در آن، مدل‌ها خیلی زودتر از پایان پردازش، تصمیم نهایی خود را درباره پاسخ‌ها می‌گیرند.

این کشف نشان می‌دهد که دقت مدل‌ها در این لایه تثبیت می‌شود و حتی تغییرات بعدی (Fine-tuning) هم تأثیر چندانی روی آن ندارد. این یعنی می‌توانیم در آینده مدل‌های هوش مصنوعی سریع‌تر و بهینه‌تری داشته باشیم که «کمتر فکر می‌کنند ولی دقیق‌تر تصمیم می‌گیرند!»

اگر به مباحث فنی و معماری هوش مصنوعی علاقه دارید، این پژوهش دید عمیقی به «جعبه سیاه» مغز مدل‌های زبانی می‌دهد.

‌های_زبانی

منبع: arXiv AI