🚀 پایان محدودیت تولید ترتیبی؛ معرفی Parallel Decoder Transformer 🤖

⚠️ هشدار به محققان: چرا دقت مدل‌های شناسایی پهپاد گاهی «واقعی» نیست؟

تا امروز مدل‌های زبانی به صورت خطی و کلمه به کلمه متن تولید می‌کردند، اما معماری جدید «PDT» بازی را تغییر داده است! 💡

محققان در این پژوهش با معرفی «Parallel Decoder Transformer»، معماری جدیدی طراحی کرده‌اند که به مدل اجازه می‌دهد به جای یک مسیر، همزمان چندین بخش از یک متن طولانی را تولید کند. این مدل با داشتن یک هسته دانشی مشترک و چندین «decoder stack» مستقل، می‌تواند با استفاده از یک برنامه‌ریز، محتوا را به صورت موازی پیش ببرد.

این یعنی در آینده‌ای نزدیک، سرعت تولید متن توسط هوش مصنوعی می‌تواند چندین برابر شود بدون اینکه کیفیت یا پیوستگی متن افت کند. یک قدم بزرگ دیگر به سمت مدل‌های هوشمندتر و سریع‌تر! ⚡️

منبع: arXiv AI