محققان به روش جدید و جذابی برای بازیابی سورسکد از فایلهای باینری دست پیدا کردهاند! در این روش، به جای تولید کدهای گنگ (Pseudo-code)، با ترکیب «مهندسی معکوس» و «استدلال مدلهای زبانی بزرگ (LLM)»، سورسکد اصلی از دیتابیسهای معتبر شناسایی و بازیابی میشود.
این ابزار با استخراج نشانگرهایی مثل رشتهها، ثابتها و توابع، دقت بسیار بالایی (تا بیش از ۹۵ درصد در برخی تستها) برای بازگردانی کدهای بهینه شده ارائه میدهد. این دستاورد میتواند تحولی بزرگ در تحلیل بدافزارها و عیبیابی کدهای قدیمی باشد. 💻✨
منبع: arXiv AI
