محققان بهتازگی بنچمارک جدیدی به نام «OmniFood-Bench» معرفی کردند تا توانایی مدلهای بزرگ چندوجهی (VLM) را در درک مواد غذایی، تحلیل ارزش غذایی و ارائه توصیههای پزشکی بسنجند. 🧐
نتیجه تحقیقات روی مدلهای پیشرفتهای مثل GPT-5.1 و Gemini-3-Flash جالب است: این مدلها در تشخیص نام غذاها عالی عمل میکنند، اما در تخمین وزن واقعی مواد و ارائه توصیههای ایمن برای سلامتی، ضعفهای جدی (و گاهی خطرناک) دارند. این «شکاف معنایی-فیزیکی» نشان میدهد که هنوز تا اعتماد کامل به AI برای رژیمهای درمانی فاصله داریم. 🤖🥗
منبع: arXiv AI
