مدلهای زبانی بزرگ (LLM) در تبدیل متن به پرسوجوهای پایگاه داده (Text-to-SQL) بسیار قدرتمند هستند، اما هنوز با چالشهای امنیتی جدی دست و پنجه نرم میکنند. محققان به تازگی چارچوب جدیدی به نام SAGE را معرفی کردهاند که به صورت خودکار ضعفهای مدلها را شناسایی میکند.
ویژگیهای کلیدی SAGE:
🔹 کشف خودکار: جایگزینی روشهای قدیمی و دستی با یک سیستم هوشمند برای بررسی رفتارهای مدل.
🔹 کتابخانه آسیبپذیری (Vulnerability Codex): مستندسازی الگوهای خرابی مدل برای جلوگیری از تکرار اشتباهات.
🔹 پایداری بیشتر: این روش نه تنها ضعفها را پیدا میکند، بلکه مسیرهایی را برای بهبود و مقاومسازی مدلها در برابر حملات ارائه میدهد.
این تحقیق گام بزرگی برای استفاده امن از هوش مصنوعی در محیطهای حساس و مدیریت دیتابیسهای واقعی است. 🚀
منبع: arXiv AI
