🎞 فشرده‌سازی ویدیو با قدرت هوش مصنوعی؛ پایان دوران فرمت‌های کلاسیک؟

⚠️ هشدار به محققان: چرا دقت مدل‌های شناسایی پهپاد گاهی «واقعی» نیست؟

محققان در یک پژوهش نوآورانه، روش جدیدی برای فشرده‌سازی ویدیو و صدا معرفی کرده‌اند که به جای ذخیره پیکسل‌ها، از «شبکه‌های عصبی نمایشی» (SIREN) استفاده می‌کند. در این متد، ویدیو و صدا به شکل وزن‌های یک مدل عصبی ذخیره می‌شوند که می‌تواند مختصات فضا-زمان را به رنگ و صوت ترجمه کند.

این فناوری نه تنها حجم فایل‌ها را به شکل چشمگیری کاهش می‌دهد، بلکه راه را برای نسل جدیدی از کدک‌های مبتنی بر یادگیری ماشین باز کرده که می‌توانند آینده استریم و ذخیره‌سازی محتوا را متحول کنند. البته فعلاً این روش در مقایسه با استانداردهایی مثل H.264 در برخی زمینه‌ها کوتاه آمده، اما شروع بسیار هیجان‌انگیزی برای کاهش پهنای باند است! 🚀

منبع: arXiv AI