تا حالا به این فکر کردید که یک فایل PDF ساده چطور میتواند امنیت مدلهای هوش مصنوعی را به خطر بیندازد؟ محققان بهتازگی بنچمارک جدیدی به نام «CrackedPDFs» را معرفی کردهاند که به بررسی «تزریق پرامپت پنهان» (Hidden Prompt Injection) در اسناد PDF میپردازد.
نکته مهم اینجاست که بسیاری از سیستمهای مبتنی بر هوش مصنوعی، فایلهای PDF را قبل از بررسیِ امنیتی «تخت» (Flatten) میکنند؛ همین کار باعث میشود کدهای مخفی یا دستورات مخربی که درون لایههای PDF پنهان شدهاند، از دید سیستمهای امنیتی پنهان بمانند. محققان با استفاده از این دیتاسیت بزرگ (شامل حدود ۳۰ هزار فایل)، روشهای جدیدی برای شناسایی این حملاتِ هوشمندانه طراحی کردهاند.
این تحقیق گامی مهم برای درک بهتر آسیبپذیری مدلهای زبانی است که با اسناد دنیای واقعی کار میکنند.
منبع: arXiv AI
