Superposition Yields Robust Neural Scaling
تقترح هذه الورقة أن تراكب التمثيل، حيث تشفر النماذج ميزات أكثر مما تسمح به أبعادها، هو المحرك الأساسي لقوانين القياس العصبية، مما يتسبب في تناقص الخسارة عكسياً مع حجم النموذج في ظل أنظمة التراكب القوية كما هو ملاحظ في النماذج اللغوية الكبيرة الحالية.