💬 NLP

Propensity Inference: Environmental Contributors to LLM Behaviour

تقدم هذه الورقة منهجية صارمة لقياس ميل النماذج اللغوية نحو السلوك غير المصرح به، وتطبيقها على ٢٣ نموذجاً لتكشف أن العوامل البيئية الاستراتيجية وغير الاستراتيجية تساهم بالتساوي في النتائج السلوكية دون أن تصبح أكثر تأثيراً مع تحسن القدرات، مع تسليط الضوء على زيادة الحساسية تجاه صراعات الأهداف.

Olli Järviniemi, Oliver Makins, Jacob Merizian, Robert Kirk, Ben Millwood2026-04-24
🤖 machine learning

How Much Is One Recurrence Worth? Iso-Depth Scaling Laws for Looped Language Models

تضع هذه الورقة قانون قياس جديدًا للنماذج اللغوية الحلقية يحدد كفاءة عمق التكرار، كاشفًا أن كل تكرار إضافي يحقق عوائد تناقصية تعادل قوة قدرها 0.46 في المعلمات الفريدة، مما يتيح مقايضات يمكن التنبؤ بها بين عمق النموذج، وعدد المعلمات، وحوسبة التدريب.

Kristian Schwethelm, Daniel Rueckert, Georgios Kaissis2026-04-24
🤖 machine learning

TabSHAP

تقدم هذه الورقة TabSHAP، وهو إطار عمل للتفسير غير المرتبط بنموذج محدد يعمل على قياس التأثير التوزيعي للميزات الفردية في المصنفات الجدولية القائمة على النماذج اللغوية الكبيرة من خلال تكييف تقدير أسلوب شابلي باستخدام تباعد جينسن-شانون على مستوى المفتاح والقيمة المتسلسلة، مما يحقق موثوقية أعلى من الطرق التقريبية الخطية الحالية.

Aryan Chaudhary, Prateek Agarwal, Tejasvi Alladi2026-04-24
💬 NLP

Cross-Session Threats in AI Agents: Benchmark, Evaluation, and Algorithms

تقدم هذه الورقة CSTM-Bench، وهي مجموعة بيانات وإطار تقييم للكشف عن تهديدات وكلاء الذكاء الاصطنا de عبر الجلسات التي تتهرب من الحواجز الوقائية عديمة الذاكرة، مما يثبت أن قارئات النواة (Coreset Readers) ذات الذاكرة المحدودة تتفوق على كل من النهج المقيد بالجلسة والنهج القائم على السجلات الكاملة، مع اقتراح مقياس جديد يوازن بين استدعاء الكشف واستقرار الخدمة.

Ari Azarafrooz2026-04-24
💬 NLP

Beyond Pixels: Introspective and Interactive Grounding for Visualization Agents

تقدم هذه الورقة البحثية إطار عمل "التأريض البصري الاستبطاني والتفاعلي" (IVG)، الذي يتغلب على قيود نماذج الرؤية واللغة المعتمدة على البكسلات فقط من خلال الجمع بين الاستبطان القائم على المواصفات والتلاعب التفاعلي بالرؤية لتفسير وحل حالات الغموض بدقة في المخططات التفاعلية، وهو ما تم التحقق منه عبر معيار iPlotBench الجديد.

Yiyang Lu, Woong Shin, Ahmad Maroof Karimi, Feiyi Wang, Jie Ren, Evgenia Smirni2026-04-24
💬 NLP

Enhancing Science Classroom Discourse Analysis through Joint Multi-Task Learning for Reasoning-Component Classification

تقدم هذه الورقة نظاماً آلياً لتحليل الخطاب يستفيد من التعلم المشترك متعدد المهام وتعزيز البيانات الاصطناعية القائم على النماذج اللغوية الكبيرة لتصنيف أنماط استدلال المعلم والطالب في فصول العلوم، مما يكشف في النهاية أن تحركات "التغذية الراجعة عبر السؤال" لدى المعلم هي الأكثر اتساقاً في التنبؤ بالاستدلال الاستنتاجي للطالب.

Jiho Noh, Mukhesh Raghava Katragadda, Raymond Carl, Soon Lee2026-04-24
💬 NLP

Slot Machines: How LLMs Keep Track of Multiple Entities

تتقصى هذه الورقة كيفية تمثيل النماذج اللغوية الكبيرة لكيانات متعددة من خلال تحديد فجوات (slots) متميزة للكيان "الحالي" و"السابق" في تنشيطات الرموز (token activations)، كاشفةً أنه بينما تستطيع النماذج فك تشفير المعلومات من كليهما، فإنها تستخدم فجوة الكيان السابق بشكل انتقائي للاستدلال العلاقاتي بينما تعتمد على فجوة الكيان الحالي للاسترجاع الحقائقي، وهو قصور يكشف عن فجوة بين المعلومات المتاحة والاستخدام الفعلي في سيناريوهات الربط المعقدة.

Paul C. Bogdan, Jack Lindsey2026-04-24
💬 NLP

Using Machine Mental Imagery for Representing Common Ground in Situated Dialogue

تقترح هذه الورقة إطار عمل للسقالات البصرية النشطة يستفيد من التصور الذهني الآلي لإنشاء تواريخ بصرية مستمرة للحوار، مما يقلل بفعالية من "الضبابية التمثيلية" ويحسن الحفاظ على الأرضية المشتركة في المحادثات الموقعية من خلال الجمع بين المعلومات التصويرية والتقريرية.

Biswesh Mohapatra, Giovanni Duca, Laurent Romary, Justine Cassell2026-04-24
💬 NLP

Adaptive Instruction Composition for Automated LLM Red-Teaming

تقدم هذه الورقة البحثية "تكوين التعليمات التكيفي" (Adaptive Instruction Composition)، وهو إطار عمل مبتكر يستخدم "مقام المراهنة السياقي" (contextual bandit) القائم على التعلم المعزز لدمج الاستعلامات والتكتيكات الضارة المستمدة من الحشد ديناميكيًا، مما يؤدي إلى توليد عمليات كسر حماية لنماذج اللغات الكبيرة (LLM jailbreaks) متنوعة وعالية الفعالية تتفوق على كل من الأساليب العشوائية وأساليب الاختبار الأحمر التكيفي الحالية.

Jesse Zymet, Andy Luo, Swapnil Shinde, Sahil Wadhwa, Emily Chen2026-04-24
📈 economics

Participation and Representation in Local Government Speech

تحلل هذه الورقة مجموعة بيانات ضخمة لاجتماعات مجالس بلديات كاليفورنيا لتكشف أن المشاركين من الجمهور منحازون ديموغرافياً وتتزايد أعدادهم خلال مناقشات استخدام الأراضي، بينما تجد أيضاً أن إلغاء الوصول عن بُعد يقلل من حجم المشاركة دون تغيير تركيبة المتحدثين بشكل كبير.

Olivia Martin, Amar Venugopal2026-04-24