محققان در مقاله جدیدی، پارادایم فعلی آموزش مدلهای زبانی بزرگ (LLMs) را زیر سوال بردهاند. این مطالعه نشان میدهد که دانش چندزبانه مدلهای امروزی، حاصل «تصادف» و آموزش روی حجم انبوهی از دادههای اینترنتی است، نه یک طراحی اصولی و هدفمند! 🧠
نتیجه این رویکرد، ایجاد مدلهایی است که در زبانهای مختلف، رفتارهای متناقض، شکننده و غیرقابل اعتماد دارند؛ موضوعی که در پروژههای حساس و عاملیتهای هوش مصنوعی (Agentic AI) میتواند فاجعهبار باشد.
نویسندگان مقاله پیشنهاد میدهند که به جای تکیه بر «چندزبانگیِ تصادفی»، باید به سمت «چندزبانگیِ طراحیشده» حرکت کنیم؛ جایی که درک عمیق فرهنگی و عدالت در عملکردِ زبانی، از همان ابتدای آموزشِ مدل به عنوان یک هدف اصلی در نظر گرفته شود. 🎯
نظر شما چیست؟ آیا به نظرتان هوش مصنوعی بالاخره میتواند تفاوتهای ظریف فرهنگی و زبانی را به خوبی درک کند؟
منبع: arXiv NLP
