اوپنایآی به تازگی از یک ابزار جدید به نام «GPT-Red» رونمایی کرده که در واقع یک مدل هوش مصنوعیِ «ابر-هکر» است! وظیفه این مدل، حمله به سایر مدلهای هوش مصنوعی و شناسایی نقاط ضعف امنیتی آنهاست تا قبل از انتشار عمومی، حفرههای مدلها شناسایی و مسدود شوند.
این رویکرد که نوعی «تست نفوذ خودکار» محسوب میشود، گام مهمی در جهت افزایش ایمنی و کاهش احتمال سوءاستفاده از هوش مصنوعیهای قدرتمند است. به نظر میرسد این رقابت بین هکرهای ماشینی و مدافعان مدلها، آینده امنیت در دنیای AI را شکل خواهد داد. 🤖💻
منبع: Hacker News LLM
