محققان در پژوهشی جدید، سیستم هوشمندی طراحی کردهاند که مشکل رایج «توهم» (Hallucination) در مدلهای زبانی را هنگام کار با متون علمی تخصصی به شکل چشمگیری حل میکند.
این معماری جدید با ترکیب یک مدل بینایی-زبانی (Qwen2-VL) و سیستمهای بازیابی پیشرفته (Hybrid Retrieval)، نه تنها دادههای متنی، بلکه جداول و تصاویر علمی را هم به دقت تحلیل میکند.
نتایج این تحقیق نشان میدهد که کیفیت استخراج اطلاعات تا ۱۵۷ درصد بهبود یافته است؛ آن هم با کمترین تاخیر و هزینهای که با مدلهای ابری بزرگ رقابت میکند! گامی بزرگ برای محققانی که با حجم عظیمی از دادههای علمی سر و کار دارند. 🔬📊
منبع: arXiv AI



