Choosing features for classifying multiword expressions
تقترح هذه الورقة إطاراً مطوراً لتصنيف التعبيرات متعددة الكلمات من خلال تقييم واختيار الميزات الأكثر موثوقية لضمان كون الفئات الناتجة مثمرة للاستخدام الحوسبي عبر لغات مختلفة.
11158 ورقة بحثية
تقترح هذه الورقة إطاراً مطوراً لتصنيف التعبيرات متعددة الكلمات من خلال تقييم واختيار الميزات الأكثر موثوقية لضمان كون الفئات الناتجة مثمرة للاستخدام الحوسبي عبر لغات مختلفة.
تقدم هذه الورقة أول تفسير نظري لاستقرار "التطبيع مدى الحياة" (Lifelong Normalization) في تحرير النماذج المتسلسل، حيث تثبت دوره في منع النسيان الكارثي وتقدم StableEdit، وهو أسلوب يعزز الاستقرار طويل الأمد من خلال مرحلة إحماء صريحة وتبييض كامل.
تُثبت هذه الورقة أن المعايرة الاحتمالية هي قدرة قابلة للتدريب في النماذج اللغوية، حيث تُظهر أن الضبط الدقيق على مهام التوزيع الاصطناعي يحسن بشكل كبير دقة أخذ العينات عبر مختلف المعايير، مع تفوق أساليب الأهداف الصلبة في أخذ العينات الرقمية المهيكلة وأداء أساليب الأهداف اللينة بشكل أفضل في مهام التوليد العشوائي الأوسع نطاقاً.
تقدم هذه الورقة البحثية TABOM، وهو إطار عمل للتدريب اللاحق يعتمد على التقطير الذاتي والوعي بالمسار، يعمل على سد الفجوة بين التدريب والاستدلال في نماذج اللغات الانتشارية من خلال نمذجة تفضيلات كشف القناع أثناء الاستدلال كتوزيع بولتزمان لاستخلاص هدف ترتيب زوجي، مما يعزز اكتساب المعرفة ويخفف من النسيان الكارثي مقارنة بالضبط الدقيق القياسي.
يقدم UniVLR إطار عمل موحداً للاستدلال الكامن البصري للنماذج اللغوية الكبيرة متعددة الوسائط، يقوم بضغط آثار الاستدلال النصي والأدلة البصرية في رموز بصرية مدمجة، مما يتيح استدلالاً فعالاً خالياً من النصوص يتفوق على الأساليب المتداخلة الحالية.
تقدم هذه الورقة طريقة لتجميع القواعد المحلية من خلال مقارنة توافقاتها لتحديد علاقات الاحتواء والتقاطع والانفصال، والتي طُبقت بنجاح لتحسين التعرف على أسماء الأشخاص البرتغالية في مجموعة بيانات HAREM، محققةً مقياس F قدره 76.86 وزيادة قدرها 6 نقاط عن أحدث ما توصل إليه العلم.
تقدم هذه الورقة البحثية RuDE، وهو إطار تقييم تمييزي قائم على معايير التقييم (rubric) يتنبأ بإمكانات ما بعد التدريب للنماذج اللغوية الكبيرة (LLM) مسبقة التدريب بمعامل ارتباط يتجاوز 90% من خلال تحليل التمييز في الاستجابة بدلاً من التوليد، مما يتيح الاختيار الفعال للنماذج الأصغر ذات الإمكانات العالية.
تقدم هذه الورقة البحثية SkillSafetyBench، وهو معيار مرجعي يوضح أن المهارات القابلة لإعادة الاستخدام والقطع البرمجية المحلية يمكن أن تؤدي إلى سلوكيات غير آمنة للوكيل حتى من طلبات المستخدمين الحميدة، مما يكشف أن سلامة الوكيل تعتمد بشكل حاسم على كيفية تفسير النماذج للمهارات وثقتها في سياقات سير العمل بدلاً من مجرد الاعتماد على التوافق على مستوى النموذج.
تقترح الورقة البحثية إطار عمل SAGE، وهو إطار عمل قابل للتوسع يستفيد من النماذج الأصغر التي تم ضبطها بدقة مع التعلم المعزز ومُحقِّق قائم على معايير التقييم لتوليد متغيرات قوية ومنخفضة التكلفة لمعايير معرفة النماذج اللغوية الكبيرة تلقائياً، محققاً جودة تضاهي المعايير المُصنفة بشرياً دون الحاجة إلى ضبط دقيق خاص بالمهمة.
تقترح الورقة البحثية إطار عمل SKILLGRAPH، الذي يمثل المهارات كعُقد في رسم بياني موجه ومتطور لتمكين وكلاء النماذج اللغوية الكبيرة من استرجاع رسوم بيانية فرعية للمهارات مرتبة للمهام التركيبية، مما يؤدي إلى تحسين كل من صيانة المكتبة والأداء المتفوق في التعلم المعزز.