برگزیده ها مشاهده همه ›
Hacker News LLM مشاهده همه ›
شرکتهای هوش مصنوعی مشاهده همه ›
مقالات علمی مشاهده همه ›
-
🚀 شناسایی دقیق اهداف کوچک در تصاویر مادون قرمز با مدل جدید LCPNet
محققان در تازهترین دستاورد خود، مدل LCPNet را برای بهبود تشخیص اهداف کوچک در تصاویر مادونقرمز (IRSTD) معرفی کردهاند. این تکنیک که در حوزه…
-
🚀 بهینهسازی مدلهای بینایی-زبانی با روش نوآورانه SaMer
مدلهای پیشرفته بازیابی بینایی-زبانی به دلیل تعداد بسیار زیاد توکنهای تصویری، معمولاً بسیار سنگین و پرهزینه هستند. اما حالا محققان فریمورک جدیدی به نام…
-
🛡 شناسایی ویدیوهای جعلی با هوش مصنوعی؛ معرفی فریمورک قدرتمند G2VD
با پیشرفت سریع ابزارهای تولید ویدیو، تشخیص محتوای جعلی به یک چالش امنیتی بزرگ تبدیل شده است. بیشتر مدلهای فعلی وقتی با ویدیوهای ساختهشده…
-
🤖 مهارت جدید رباتها: سیمکشی هوشمند با تکیه بر هوش مصنوعی!
یکی از کارهای سخت برای رباتها، کار با اشیاء منعطف مثل کابلها و طنابهاست. حالا محققان با معرفی فریمورک «SILO»، روشی خلاقانه برای حل…
-
🚀 ارتقای درک اسناد طولانی؛ معرفی HIEVI-RAG برای بازیابی دقیقتر اطلاعات
مدلهای RAG معمولاً در پردازش اسناد بسیار طولانی دچار سردرگمی میشوند و اطلاعات بیربط را به جای پاسخ نهایی به کاربر ارائه میدهند. محققان…
-
🛡 حفره امنیتی جدید در LLMها؛ وقتی مدلها فریب میخورند!
محققان تکنیک جدیدی به نام RetroCoT معرفی کردهاند که نشان میدهد مدلهای زبانی بزرگ تا چه حد در برابر «تغییر لحن درخواست» آسیبپذیر هستند.…
-
🧠 غربالگری دقیقتر افسردگی با کمک یادگیری ماشین و ریتمهای شبانهروزی
محققان در مطالعهای جدید، روشی نوآورانه برای تشخیص و تحلیل افسردگی از طریق دادههای رفتاری ابداع کردهاند. این مدل با استفاده از مفهومی به…
-
🚗 تحول در بینایی ماشین برای خودروهای خودران؛ معرفی FocusGS
بازسازی سهبعدی محیط در خودروهای خودران یکی از چالشهای بزرگ دنیای هوش مصنوعی است. محققان بهتازگی چارچوب جدیدی به نام FocusGS معرفی کردهاند که…
-
🚀 انقلابی در اجرای مدلهای زبانی روی سیستمعامل؛ معرفی Elastic Gang
تا به حال به این فکر کردید که چرا اجرای LLMها روی سیستمهای شخصی باعث کندی بقیه برنامهها میشود؟ محققان در دستاورد جدیدی به…
-
🧠 آیا رباتها واقعاً «فکر» میکنند؟ حقیقت پشت استدلال مدلهای بصری-زبانی
محققان در مطالعهای جدید به سراغ چالشی بزرگ در دنیای رباتیک رفتهاند: آیا مدلهای VLA (بینایی-زبان-عمل) واقعاً بر اساس منطق تصمیم میگیرند یا فقط…









