🧠 آیا مدل‌های هوش مصنوعی واقعاً می‌توانند در متون طولانی حقیقت را پیدا کنند؟

⚠️ هشدار به محققان: چرا دقت مدل‌های شناسایی پهپاد گاهی «واقعی» نیست؟

یک تحقیق جدید نشان می‌دهد که مدل‌های زبانی بزرگ (LLM) مثل ChatGPT-5-mini یا Claude-4.5-haiku در مواجهه با متون بسیار طولانی، با چالش‌های عجیبی روبرو هستند. این مطالعه دو مشکل اصلی را شناسایی کرده است:

۱. «فروپاشی توزیعی»: وقتی اطلاعات کلیدی در متن پخش شده باشند، مدل‌ها دقت خود را از دست می‌دهند.
۲. «مالیات ایمنی»: پرامپت‌های ضد توهم (مثل «از خودت حرف در نیاور») گاهی باعث می‌شوند مدل بیش از حد محتاط شود و حتی واقعیت‌های موجود در متن را هم انکار کند!

این تحقیق تاکید می‌کند که برای استفاده در سیستم‌های هوشمند واقعی، صرفاً داشتن «پنجره متنی بزرگ» کافی نیست و مدل‌ها باید در مدیریت و اولویت‌بندی اطلاعات هوشمندتر عمل کنند.

منبع: arXiv AI