🚀 هوش مصنوعی و انقلابی در تشخیص خطای صنعتی با مدل‌های بینایی-زبانی! 🔍

🧠 چرا هوش مصنوعی گاهی «خیالات» می‌بیند؟

محققان با معرفی فریم‌ورک جدید OPD-IAD، چالش بزرگ مدل‌های بینایی-زبانی (LVLM) در تشخیص دقیق نقص‌های صنعتی را هدف قرار داده‌اند.

مشکل اصلی مدل‌های فعلی این بود که نمی‌توانستند از توصیفات متنی، نقشه‌های پیکسلی دقیق برای تشخیص خرابی ایجاد کنند. اما با استفاده از روش «تقطیر خودکار سیاست‌محور» (On-Policy Self-Distillation)، این مدل جدید یاد می‌گیرد که زبان را به عنوان یک راهنمای متنی برای نظارت دقیق بر جزئیات بصری به کار بگیرد.

به زبان ساده: این مدل حالا می‌تواند دقیقاً همانند یک متخصص، روی تصاویر صنعتی زوم کرده و نقص‌ها را با دقت پیکسل‌به‌پیکسل شناسایی کند، بدون اینکه درگیر ابهامات زبانی شود! 🛠️✨

منبع: arXiv AI