تا امروز مدلهای زبانی به صورت خطی و کلمه به کلمه متن تولید میکردند، اما معماری جدید «PDT» بازی را تغییر داده است! 💡
محققان در این پژوهش با معرفی «Parallel Decoder Transformer»، معماری جدیدی طراحی کردهاند که به مدل اجازه میدهد به جای یک مسیر، همزمان چندین بخش از یک متن طولانی را تولید کند. این مدل با داشتن یک هسته دانشی مشترک و چندین «decoder stack» مستقل، میتواند با استفاده از یک برنامهریز، محتوا را به صورت موازی پیش ببرد.
این یعنی در آیندهای نزدیک، سرعت تولید متن توسط هوش مصنوعی میتواند چندین برابر شود بدون اینکه کیفیت یا پیوستگی متن افت کند. یک قدم بزرگ دیگر به سمت مدلهای هوشمندتر و سریعتر! ⚡️
منبع: arXiv AI
