محققان در یک مقاله جدید، مرزهای نظری شبکههای عصبی ReLU را جابهجا کردند! این تیم نشان داد که میتوان عملیات «بیشینه» (max) برای ۱۰ عدد را تنها با دو لایه پنهان نمایش داد و برای مقادیر بزرگتر نیز محدودیتهای عمق شبکه را به شکل قابلتوجهی کاهش داد.
چرا این موضوع مهم است؟
این یافتهها نه تنها درک ریاضی ما از عملکرد توابع piecewise-linear را بهبود میبخشد، بلکه راه را برای طراحی مدلهای بهینهتر و با معماری سادهتر باز میکند. این دستاورد در واقع بهبود مستقیمی بر نتایج کنفرانس STOC ۲۰۲۶ محسوب میشود. 🧠✨
منبع: arXiv Machine Learning
