🔍 چالش عدالت و سوگیری در هوش مصنوعی: آیا مدل‌ها برای تشخیص سلامت روان قابل اعتمادند؟

⚠️ هشدار به محققان: چرا دقت مدل‌های شناسایی پهپاد گاهی «واقعی» نیست؟

محققان در پژوهشی جدید به بررسی دقیق عملکرد مدل‌های بینایی-زبانی (VLM) در ارزیابی سلامت روان پرداخته‌اند. نتایج نشان می‌دهد که مدل‌هایی مثل Phi-3.5 و Qwen2-VL، علی‌رغم توانمندی‌هایشان، با چالش‌های جدی «سوگیری‌های نژادی و جنسیتی» و «عدم شفافیت» روبرو هستند.

این مطالعه تأکید می‌کند که استفاده از هوش مصنوعی در حوزه‌های حساسی مانند پزشکی و روان‌شناسی، نیازمند نظارت دقیق‌تر است؛ چرا که تلاش برای افزایش عدالت در این مدل‌ها (از طریق روش‌های XAI) گاهی اوقات می‌تواند به قیمت کاهش دقت یا حتی تشدید سوگیری‌ها تمام شود.

این یافته‌ها یادآوری مهمی است که پیش از اعتماد به AI در تصمیمات بالینی، باید راهکارهای علمی مطمئنی برای رفع سوگیری‌های پنهان مدل‌ها پیدا کرد.

منبع: arXiv AI