🚀 افزایش سرعت تولید متن با مدل‌های دیفیوژن: معرفی روش نوآورانه PRESTO

🧠 چرا هوش مصنوعی گاهی «خیالات» می‌بیند؟

محققان در مقاله جدیدی، فریم‌ورک «PRESTO» را برای بهبود سرعت و دقت در مدل‌های زبانی مبتنی بر دیفیوژن (dLLMs) معرفی کرده‌اند.

مدل‌های دیفیوژن که به دلیل تولید موازی توکن‌ها شناخته می‌شوند، در روش «رمزگشایی حدسی» (Speculative Decoding) بسیار کارآمد هستند. اما مشکل اصلی روش‌های فعلی این است که با ساختار خطی عمل می‌کنند. PRESTO با استفاده از «درخت‌بندی پیشوند-تراز» (Prefix-Aligned Tree Drafting)، اجازه می‌دهد مدل مسیرهای احتمالی بیشتری را بررسی کرده و با تطبیق دقیق‌تر با مدل‌های اتورگرسیو (AR)، سرعت تولید و طول توکن‌های پذیرفته شده را به شکل چشمگیری افزایش دهد.

این یعنی هوش مصنوعی‌های نسل آینده نه تنها هوشمندتر، بلکه بسیار سریع‌تر خواهند بود! ⚡️

منبع: arXiv AI