مدلهای ترنسفورمر (Transformer) اغلب مثل یک «جعبه سیاه» عمل میکنند که درک تصمیمگیریهای داخلی آنها دشوار است. حالا محققان با معرفی رویکرد جدید Legible-by-Construction، گام بزرگی برای حل این چالش برداشتهاند! 🏗️
این معماری جدید با ترکیب عملیات منطقی فازی و مکانیسم توجه (Attention)، باعث میشود بخشهای پنهان مدل برای ما انسانها «خواناتر» و قابلدرکتر شوند. جالب اینجاست که این روش نه تنها کیفیت مدل را کاهش نمیدهد، بلکه بدون نیاز به پارامترهای اضافی، بخشهای مختلف مدل را به آشکارسازهای دقیق و هوشمند تبدیل میکند.
این دستاورد یعنی در آینده، هوش مصنوعی کمتر یک جعبه سیاه مرموز خواهد بود و ما درک دقیقتری از چراییِ تولید خروجیها توسط مدلها خواهیم داشت.
منبع: arXiv Machine Learning
