The Pre-Training Study of Expanded-SPLADE Models on Web Document Titles
تستقصي هذه الورقة تجريبياً كيف تؤثر مجموعات بيانات ما قبل التدريب والبارامترات الفائقة على نماذج Expanded-SPLAE لعمليات الاسترجاع، كاشفةً أن النماذج التي تم تدريبها مسبقاً على مجموعات نصوص عامة وبمعدلات تعلم أعلى تحقق فعالية متفوقة حتى في ظل التقليم الصارم، رغم انخفاض دقة نموذج اللغة (MLM) وزيادة تكاليف الاسترجاع.