پژوهش جدیدی روی مدلهای زبانی (LLM) نشان میدهد که این مدلها گاهی اوقات قبل از تحلیل منطقی، نسبت به یک پاسخ «متعهد» میشوند و بعد سعی میکنند با استدلالهای ساختگی آن را توجیه کنند!
در یک آزمایش جالب، محققان از مدل Qwen3-8B پرسیدند: «میخواهم ماشینم را بشویم، کارواش ۱۰۰ متر با من فاصله دارد؛ پیاده بروم یا با ماشین؟» با اینکه پاسخ منطقی «با ماشین» است (چون باید ماشین را به کارواش برد)، مدل در اکثر مواقع اصرار دارد که «پیاده» بروید!
نتایج این تحقیق نشان میدهد که این رفتار حتی با افزایش بودجه تفکر (Thinking budget) هم اصلاح نمیشود. بررسیهای لایههای درونی مدل ثابت میکند که مدل پیش از نوشتن متن، در ذهن خود تصمیم نهایی را گرفته است. این یعنی سیستمهای هوش مصنوعی هنوز در جداسازی «تصمیمگیری» از «استدلال» ضعفهای عمیقی دارند که میتواند منجر به خطاهای سوگیری شود.
منبع: arXiv AI
