دانشمندان در تحقیق جدیدی به سراغ چالش «تایید کد» توسط هوش مصنوعی رفتهاند. مشکل اینجاست که وقتی هوش مصنوعی کد مینویسد و خودش هم تستهای آن را میسازد، ممکن است باگها را نادیده بگیرد.
این مقاله نشان میدهد که چطور با استفاده از یک سیستم «تست سختگیرانه» (Adversarial Test-Hardening) که در آن دو مدل هوش مصنوعی به صورت متقابل و بدون دخالت انسانی، عملکرد یکدیگر را ارزیابی میکنند، میتوان باگهای پنهانی را پیدا کرد که تستهای معمولی از آنها غافل میشوند. این تحقیق نشان داد که طراحیِ درستِ فرآیندِ بازبینی، تا ۷۸٪ در شناسایی خطاهای باقیمانده موثر است!
یک قدم رو به جلو برای اینکه به کدهای تولید شده توسط ماشین، اعتمادِ علمی بیشتری داشته باشیم.
منبع: arXiv AI
