محققان در یک پژوهش نوآورانه، روش جدیدی برای فشردهسازی ویدیو و صدا معرفی کردهاند که به جای ذخیره پیکسلها، از «شبکههای عصبی نمایشی» (SIREN) استفاده میکند. در این متد، ویدیو و صدا به شکل وزنهای یک مدل عصبی ذخیره میشوند که میتواند مختصات فضا-زمان را به رنگ و صوت ترجمه کند.
این فناوری نه تنها حجم فایلها را به شکل چشمگیری کاهش میدهد، بلکه راه را برای نسل جدیدی از کدکهای مبتنی بر یادگیری ماشین باز کرده که میتوانند آینده استریم و ذخیرهسازی محتوا را متحول کنند. البته فعلاً این روش در مقایسه با استانداردهایی مثل H.264 در برخی زمینهها کوتاه آمده، اما شروع بسیار هیجانانگیزی برای کاهش پهنای باند است! 🚀
منبع: arXiv AI
