محققان Anthropic در یک پروژه جذاب از مدل Claude Mythos خواستند تا در حوزهی پیچیده رمزنگاری به دنبال حفرههای امنیتی بگردد. نکته جالب اینجاست که این مدل با صرف هزینهای حدود ۱۰۰ هزار دلار و با تشویق مداوم محققان انسانی برای «تسلیم نشدن»، موفق شد در الگوریتمهایی مثل HAWK و نسخهای از AES، ضعفهای ریاضیاتی پیدا کند.
این آزمایش نشان میدهد که مدلهای هوشمند چقدر میتوانند در پیشبرد تحقیقات علمیِ سخت و تخصصی نقش داشته باشند، البته به شرطی که درست پرامپت شوند و انگیزه لازم را داشته باشند! 🕵️♂️💻
منبع: Simon Willison’s Blog