🕵️‍♂️ هک هوش مصنوعی فقط با زمان‌سنجی: حمله جدید LeakyLMs

🧠 چرا هوش مصنوعی گاهی «خیالات» می‌بیند؟

محققان تکنیک خلاقانه‌ای به نام LeakyLMs معرفی کرده‌اند که می‌تواند معماری و جزئیات فنی مدل‌های زبانی بزرگ (LLM) را تنها با اندازه‌گیری «زمان پاسخ‌دهی» (Token Generation Timing) استخراج کند! ⏱️

نکات کلیدی این پژوهش:
🔹 استخراج معماری: این حمله می‌تواند لایه‌ها، ابعاد پنهان و تعداد سرهای توجه (Attention Heads) را با دقت بسیار بالا حدس بزند.
🔹 افشای بهینه‌سازی‌ها: حتی می‌توان فهمید که آیا سرویس‌دهنده از تکنیک‌هایی مثل Speculative Decoding استفاده می‌کند یا خیر.
🔹 هدف‌گیری APIها: این روش حتی روی مدل‌های بسته‌ای که از طریق API در دسترس هستند نیز کار می‌کند.

این کشف جدید زنگ خطری جدی برای امنیت مدل‌های تجاری و حفظ اسرار فنی شرکت‌های بزرگ هوش مصنوعی محسوب می‌شود. امنیت مدل‌ها بیش از هر زمان دیگری در معرض چالش است!

منبع: arXiv Machine Learning