محققان در مقالهای جدید نشان دادند که چطور میتوان از توانایی مدلهای بزرگ زبانی (LLM) برای بهینهسازی و بهبود ساختار مدلهای عصبی ضعیفتر استفاده کرد.
برخلاف روشهای معمول که صرفاً کدها را کپی میکنند، این رویکرد جدید که بر پایه «هدایت منبع» (Source-Guided) بنا شده، مدلهای زبانی را ترغیب میکند تا با درک ساختار اصلی، مدلهای هدف را بهطور هوشمندانهای بازسازی و تقویت کنند. نتایج آزمایشها روی مجموعهدادههای مختلفی مثل CIFAR-10 و SVHN نشان میدهد که این روش، دقت مدلها را بهشکل خیرهکنندهای افزایش میدهد.
این تحقیق نشان میدهد که هوش مصنوعی نه تنها در تولید متن، بلکه در مهندسی دقیقتر و بهینهسازی ساختار سایر سیستمهای هوشمند نیز نقشی کلیدی ایفا خواهد کرد. 🚀
منبع: arXiv Computer Vision
