محققان تکنیک خلاقانهای به نام LeakyLMs معرفی کردهاند که میتواند معماری و جزئیات فنی مدلهای زبانی بزرگ (LLM) را تنها با اندازهگیری «زمان پاسخدهی» (Token Generation Timing) استخراج کند! ⏱️
نکات کلیدی این پژوهش:
🔹 استخراج معماری: این حمله میتواند لایهها، ابعاد پنهان و تعداد سرهای توجه (Attention Heads) را با دقت بسیار بالا حدس بزند.
🔹 افشای بهینهسازیها: حتی میتوان فهمید که آیا سرویسدهنده از تکنیکهایی مثل Speculative Decoding استفاده میکند یا خیر.
🔹 هدفگیری APIها: این روش حتی روی مدلهای بستهای که از طریق API در دسترس هستند نیز کار میکند.
این کشف جدید زنگ خطری جدی برای امنیت مدلهای تجاری و حفظ اسرار فنی شرکتهای بزرگ هوش مصنوعی محسوب میشود. امنیت مدلها بیش از هر زمان دیگری در معرض چالش است!
منبع: arXiv Machine Learning
