یک تحقیق جدید و جالب در arXiv نشان میدهد که برخلاف تصور، استفاده از سیستمهای «مباحثه چندعاملی» (Multi-Agent Debate) لزوماً باعث بهبود کیفیت بازخورد هوش مصنوعی روی مقالات علمی نمیشود!
در این آزمایش، محققان متوجه شدند که مدلهای پایه (Single Pass) همچنان عملکرد بهتری نسبت به روشهای پیچیده و پرهزینه چندعاملی از نظر نویسندگان مقالات دارند. نکته جالب اینکه این تحقیق هشدار میدهد نباید در فرآیند داوری مقالات، به سادگی قضاوت هوش مصنوعی را جایگزین داور انسانی کرد، چون حتی هوش مصنوعی هم در جایگاه «داور»، عملکرد متفاوتی نسبت به نویسنده دارد. 🧠⚖️
آینده نقد علمی با هوش مصنوعی همچنان چالشبرانگیز باقی مانده است!
منبع: arXiv NLP
