محققان در یک پژوهش جدید، روشی نوآورانه برای ارتقای توانایی مدلهای زبانی در شناسایی نقاط ضعف امنیتی در کدنویسی پایتون ارائه کردهاند. در این متد، با استفاده از الگوریتم یادگیری تقویتشده (GRPO)، مدلهای برنامهنویسی میتوانند آسیبپذیریهای امنیتی (CWE) را با دقت بسیار بالاتری شناسایی کنند.
نکته جالب اینجاست که این مدلِ بهینهشده، عملکردی مشابه مدلهای بسیار بزرگتر از خود را نشان میدهد و میتواند در مقابله با چالشهای امنیتیِ دنیای واقعی، ابزاری بسیار قدرتمند برای برنامهنویسان و متخصصان امنیت باشد. 👨💻🚀
منبع: arXiv Machine Learning
