آیا تا به حال به این فکر کردید که چرا مدلهای کدنویس گاهی تنبلی میکنند یا کدهای پیچیده را نادیده میگیرند؟ محققان راهکار جدیدی به نام SCATE ارائه دادند که نیاز به دخالت انسان در تست کدها را به حداقل میرساند.
SCATE با استفاده از یادگیری تقویتی، دقیقاً میداند کجا و چگونه کدها را تست کند تا پوشش (Coverage) و دقت برنامه بهطور چشمگیری افزایش یابد. در آزمایشها، این ابزار توانسته عملکرد مدلهایی مثل Gemini و Claude را تا ۳۰ درصد در تستهای پیچیده بهبود ببخشد.
یک گام مهم دیگر به سمت خودکارسازی واقعی فرآیند توسعه نرمافزار! 🚀
منبع: arXiv AI
