خبر خوب برای طرفداران امنیت در هوش مصنوعی! طبق گزارشهای جدید از سیستم کارتهای مدل Claude Opus 5، این مدل جدید آنتروپیک در برابر تکنیکهای «تزریق پرامپت» بسیار مقاومتر از نسخههای قبلی عمل میکند.
بوریس چرنی در تحلیل خود اشاره کرده که تیم آنتروپیک موفق شده با تستهای دقیق و تیمهای Red Teaming، سد دفاعی محکمی در برابر فریب دادن مدل ایجاد کند. این یعنی تجربه کاربری امنتر و مطمئنتر برای همه ما.
آیا فکر میکنید دوران دور زدن مدلهای هوش مصنوعی توسط کاربران به پایان رسیده است؟ نظرتان را برای ما بنویسید! 👇
منبع: Simon Willison’s Blog