بحثی داغ در جامعه فنی شروع شده: چرا آزمایشگاههای مختلف هوش مصنوعی از بنچمارکهای متفاوتی استفاده میکنند؟ 🤖
این موضوع برای همه ما که اخبار پیشرفت مدلها را دنبال میکنیم حیاتی است. در واقع، انتخاب بنچمارکها میتواند دیدگاه ما را نسبت به «هوشمندی» یک مدل تغییر دهد. آیا آزمایشگاهها سعی میکنند اعداد را به نفع خود دستکاری کنند یا استانداردهای علمی متفاوتی دارند؟ نظر شما چیست؟
منبع: Hacker News AI