💬 NLP

Attention-Guided Layer Selection for Contrastive Decoding in Large Language Models

تقترح هذه الورقة ثلاث استراتيجيات لاختيار الطبقات بتوجيه من الانتباه (Attention-JSD، وAttention-Entropy-Max، وAttention-Entropy-Min) تستفيد من آليات الانتباه الذاتي الداخلية لتحسين واقعية النماذج اللغوية الكبيرة، مما يظهر مكاسب أداء ثابتة مقارنة بطريقة DoLa الأصلية في اختبارات TruthfulQA.

Yusuke Sakai, Natthawut Kertkeidkachorn, Kiyoaki Shirai2026-07-28
💬 NLP

LoRA for Gender-Inclusive Rewriting and Activation Steering for Counter-Narrative Generation

تقدم هذه الورقة نظام IHLC الخاص بمهمة LT-EDI 2026 المشتركة، والذي يجمع بين الضبط الدقيق باستخدام تقنية LoRA لإعادة الكتابة الشاملة للنوع الاجتماعي، وتقنية توجيه التنشيط الموفرة للحوسبة باستخدام الاتجاهات الرئيسية المستمدة من تحليل المكونات الرئيسية (PCA) لتوليد السرديات المضادة، محققاً درجات عالية مع تحليل القيود الرئيسية مثل الانحراف الدلالي وتسرب التحيز.

Akhil Rajeev P, Manoj Balaji J2026-07-28
💬 NLP

Interview with Kalle Lyytinen on "Implications of Theories of Language for Information Systems"

في هذه المقابلة، يتأمل كالي ليتينين في أصول وتطور عمله الرائد حول الأسس اللغوية لنظم المعلومات، مناقشاً استمرار أهميتها في عصر النماذج اللغوية الكبيرة والذكاء الاصطناي التوليدي، مع تحديد توجهات البحث المستقبلية.

Kalle J. Lyytinen, Pierre Maier, Paul Ackah Toffey2026-07-28
🤖 machine learning

In-Context Learning as Implicit Policy Gradient

تؤسس هذه الورقة رابطاً نظرياً بين التعلم داخل السياق المشروط بالدرجة وبين تحسين تدرج السياسة، حيث تُثبت أن آليات الانتباه الذاتي يمكن أن تنفذ ضمناً تحديثات مرجحة بالمكافأة، وتقدم تحققاً تجريبياً بأن النماذج اللغوية الكبيرة تستفيد بفعالية من درجات التقييم لتحويل توزيعات المخرجات نحو الأمثلة ذات الأداء العالي.

Masahiro Kaneko, Timothy Baldwin2026-07-28
💬 NLP

Beyond a Global Norm: Personalizing Toxicity Sensitivity in Language Models Without Retraining

تقدم هذه الورقة أول تقييم مقارن للطرق الخالية من التدريب لتخصيص حساسية سمية النماذج اللغوية عبر مراحل ما قبل وفك التشفير وأثناءه وما بعده، مما يظهر تحسينات كبيرة في التوافق مع الكشف عن مقايضة متأصلة بين فعالية التخصيص وجودة اللغة العامة.

Rares A. C. Diaconescu, Iulia Slanina, Alina Florea, Andrei B. Trache, Miruna E. Coroi, Anne Arzberger, Jie Yang, Enrico (…)2026-07-28
💬 NLP

Low-Latency Turn-Taking via Context-Aware Preface Generation in a Real-World Dialogue Robot

تقترح هذه الورقة إطار عمل تدريجيًا ذا مرحلتين يولد استجابات تمهيدية مدركة للسياق لتقليل زمن تأخير الحوار، مبرهنةً من خلال تجربة روبوتية في عالم حقيقي أنه بينما يؤخر هذا النهج الاستجابة التمهيدية الأولية قليلاً مقارنة بالاستجابات التمهيدية الثابتة، فإنه يقصر بشكل كبير الفجوة قبل الاستجابة الرئيسية، مما يكشف عن مقايضة في تحسين التوقيت.

Yuki Okafuji, Koji Inoue, Yoshiki Ohira2026-07-28
💬 NLP

IndicTalk: A Large-Scale Persona-Based Multilingual Conversational Corpus for Indic Languages

تقدم هذه الورقة البحثية IndicTalk، وهو متن لغوي ضخم تم إنشاؤه تلقائياً يضم أكثر من 1.3 مليون محادثة قائمة على الشخصيات ومرتبطة بالأحداث ومتعددة اللغات (code-mixed) عبر 18 نوعاً من 9 لغات هندية، صُمم لتعزيز الذكاء الاصطناقي للمحادثات متعدد اللغات في المناطق غير الممثلة كفاية.

Sahil Deepak Gawande, Mayank Singh2026-07-28
💬 NLP

Co-Evolving Graph and Text Memory for Training-Free Multi-Hop Question Answering

تقدم الورقة البحثية نظام Co-E، وهو نظام للإجابة على الأسئلة متعددة القفزات لا يتطلب تدريباً، يستخدم ذاكرة عمل ثنائية الاتجاه متزامنة لدمج وتوفيق السياق النصي مع أدلة الرسم البياني العلاقاتي ديناميكياً، محققاً أداءً منافساً للنماذج الأكبر أو المدربة عبر ستة معايير مرجعية.

Hieu Man, Thien Huu Nguyen2026-07-28
💬 NLP

Joint Optimization for Greedy Longest-match Tokenization

تقدم هذه الورقة JOLT، وهو إطار تحسين مشترك يصيغ تعلم المفردات كبرنامج عدد صحيح مع قيود اتساق جشعة لمواءمة التدريب مع فك التشفير بأطول مطابقة، محققاً ضغطاً يقارب المثالية يتفوق بشكل كبير على BPE القياسي مع توفير شهادة على قرب المثالية.

Adhiraj Singh, Deepanshu Mody, Ghina Al Shdaifat, Hamza Alshamy, Adam Wiemerslage, Varshini Reddy, Craig W. Schmidt2026-07-28
💬 NLP

Explaining BiomedCLIP with Weighted Banzhaf Interactions Supported by Tree-Gram Parsing

تقدم هذه الورقة البحثية ParseFIxLIP، وهو إطار تفسيري مبتكر يدمج بين تحليل القواعد الشجرية (Tree-Gram Parsing) وتفاعلات بانزهاف الموزونة (Weighted Banzhaf interactions) لتجميع رموز النصوص المجزأة إلى مفاهيم طبية متماسكة دلالياً، مما يعزز قابلية التفسير والمتانة في اتخاذ القرار لنموذج BiomedCLIP في السياقات السريرية.

Jakub Rymarski (University of Warsaw, Poland), Adam Rempała (University of Warsaw, Poland), Bartłomiej Sobieski (Univers (…)2026-07-28