🍎 هوش مصنوعی و چالش سلامت: آیا مدل‌های زبانی می‌توانند متخصص تغذیه باشند؟

⚠️ هشدار به محققان: چرا دقت مدل‌های شناسایی پهپاد گاهی «واقعی» نیست؟

محققان به‌تازگی بنچمارک جدیدی به نام «OmniFood-Bench» معرفی کردند تا توانایی مدل‌های بزرگ چندوجهی (VLM) را در درک مواد غذایی، تحلیل ارزش غذایی و ارائه توصیه‌های پزشکی بسنجند. 🧐

نتیجه تحقیقات روی مدل‌های پیشرفته‌ای مثل GPT-5.1 و Gemini-3-Flash جالب است: این مدل‌ها در تشخیص نام غذاها عالی عمل می‌کنند، اما در تخمین وزن واقعی مواد و ارائه توصیه‌های ایمن برای سلامتی، ضعف‌های جدی (و گاهی خطرناک) دارند. این «شکاف معنایی-فیزیکی» نشان می‌دهد که هنوز تا اعتماد کامل به AI برای رژیم‌های درمانی فاصله داریم. 🤖🥗

منبع: arXiv AI