محققان به تازگی مجموعه داده جدیدی به نام SalAngaBhava را برای تحلیل احساسات مبتنی بر جنبه (ABSA) در زبان «سینهالی» معرفی کردهاند.
این دیتاست، شامل بررسیهای محصولات است که به صورت دستی با جزئیات دقیق برچسبگذاری شدهاند. اهمیت این کار در آن است که برای زبانهایی که دادههای کمی دارند، انجام تحلیلهای دقیق و چندبعدی (Aspect-based) همیشه یک چالش بزرگ بوده است. این دستاورد به مدلهای NLP کمک میکند تا در زبانهای خاص نیز هوشمندتر عمل کنند و دید دقیقتری نسبت به نظرات کاربران داشته باشند.
آیا به نظر شما این مدلها میتوانند به زودی تفاوتهای ظریف زبانی در فرهنگهای مختلف را کاملاً درک کنند؟ 🤔
منبع: arXiv Machine Learning
