🧬 چرا LLMها در تشخیص تخصصی آنزیم‌ها شکست می‌خورند؟

🧠 چرا هوش مصنوعی گاهی «خیالات» می‌بیند؟

مدل‌های زبانی بزرگ (LLM) شاید در مباحث عمومی فوق‌العاده باشند، اما وقتی نوبت به کارهای تخصصی علمی مثل طبقه‌بندی آنزیم‌ها می‌رسد، به مشکل می‌خورند! محققان به‌تازگی بنچمارک جدیدی به نام EC-Reason-Bench را معرفی کرده‌اند تا بفهمند دقیقاً چه چیزی باعث این «خطای استدلالی» می‌شود.

نکته جالب اینجاست که این تحقیق نشان می‌دهد با دسترسی به منابع دانش خارجی (Open-book) به‌جای تکیه بر حافظه خود مدل، دقت این هوش مصنوعی‌ها در حوزه‌های علمی تخصصی به شدت افزایش می‌یابد. در واقع، دانش مقدم بر استدلال است! 🧠✨

منبع: arXiv Machine Learning