در دنیای فناوری، بحث بر سر منابع آموزشی مدلهای بزرگ زبانی (LLM) حسابی داغ است! اخیراً در یک گفتگوی جذاب در «Hacker News»، این سوال مطرح شده که شرکتهای پیشرو هوش مصنوعی هنوز چه نوع دادههایی را برای آموزش مدلهای خود استفاده نکردهاند؟ 🤖📚
آیا همه دادههای اینترنت بلعیده شدهاند یا هنوز گنجینههایی مثل دادههای غیرعمومی، اسناد بایگانیشده یا تعاملات خاص انسانی باقی مانده که میتواند هوش مصنوعی را به مرحله بعد ببرد؟ این موضوع برای کسانی که نگران حریم خصوصی و آینده آموزش مدلها هستند، بحثی بسیار حیاتی است.
شما فکر میکنید چه چیزی هنوز از چشم مدلهای هوش مصنوعی پنهان مانده است؟
منبع: Hacker News AI