💻 computer science

CityRiSE: Reasoning Urban Socio-Economic Status in Large Vision-Language Models via Reinforcement Learning

تقدم الورقة البحثية إطار عمل CityRiSE، وهو إطار عمل مبتكر يستفيد من التعلم المعزز مع بيانات متعددة الوسائط منسقة بعناية ومكافآت قابلة للتحقق لتعزيز قدرة النماذج اللغوية البصرية الكبيرة على أداء استدلال دقيق وقابل للتفسير وقابل للتعميم للتنبؤ بالوضع الاجتماعي والاقتصادي الحضري عبر سياقات متنوعة وغير مرئية.

Tianhui Liu, Hetian Pang, Xin Zhang, Jie Feng, Pan Hui, Yong Li2026-08-14
💻 computer science

Learning Latency-Aware Orchestration for Multi-Agent Systems

تقدم الورقة البحثية إطار عمل LAMaS، وهو إطار عمل مبتكر يقلل زمن التأخير من الطرف إلى الطرف في الأنظمة متعددة الوكلاء من خلال تعلم رسوم بيانية للتنفيذ مدركة لزمن التأخير مع تخصيص ائتمان المسار الحرج أثناء التدريب، واستخدام متحكم تكيفي خفيف الوزن للقضاء على التفاعلات الزائدة أثناء الاستدلال، محققاً انخفاضاً في زمن التأخير بنسبة تزيد عن 50% مع الحفاظ على دقة المهام.

Xi Shi, Mengxin Zheng, Qian Lou2026-08-14
💬 NLP

Toward Federated Large Language Models in Medicine: A Parameter-Efficient Framework for Privacy-Preserving, Multi-Institutional Adaptation

تقدم الورقة البحثية Fed-MedLoRA و +Fed-MedLoRA، وهو إطار عمل اتحادي فعال في استخدام المعلمات يتيح التكيف التعاوني والحفاظ على الخصوصية للنماذج اللغوية الكبيرة عبر مؤسسات رعاية صحية متعددة، مما يظهر قدرة فائقة على التعميم والأداء في مهام استخراج المعلومات السريرية مقارنة بالطرق الحالية.

Anran Li, Yuanyuan Chen, Wenjun Long, Yu Yin, Yan Hu, Hyunjae Kim, Weipeng Zhou, Yujia Zhou, Hongyi Peng, Yang Ren, Xugu (…)2026-08-14
💬 NLP

SEMA: Simple yet Effective Learning for Multi-Turn Jailbreak Attacks

تُعد SEMA إطار عمل بسيطاً وذاتي الضبط، يستخدم الضبط الدقيق المسبق التعبئة والتعلم المعزز المدرك لانحراف النوايا لتدريب مهاجم "كسر الحماية" (jailbreak) متعدد الجولات دون بيانات خارجية، مما يحقق معدلات نجاح هجوم هي الأفضل في فئتها ويوفر اختبار جهد قوياً وقابلاً للتكرار لسلامة النماذج اللغوية الكبيرة.

Mingqian Feng, Xiaodong Liu, Weiwei Yang, Jialin Song, Xuekai Zhu, Chenliang Xu, Jianfeng Gao2026-08-14
💬 NLP

QUIETT: Query-Independent Table Transformation for Robust Reasoning

تقدم الورقة البحثية QuIeTT، وهو إطار عمل مستقل عن الاستعلام يحول الجداول الخام إلى تمثيل واحد موحد وجاهز للغة SQL من خلال مسار مكون من ثلاث مراحل تشمل استقصاء المشكلات، وتوليد المخطط، والتنفيذ المهيكل، مما يعزز المتانة والقدرة على التعميم في الاستدلال على الجداول والإجابة على الأسئلة عبر معايير قياسية متنوعة.

Gaurav Najpande, Tampu Ravi Kumar, Manan Roy Choudhury, Neha Valeti, Yanjie Fu, Vivek Gupta2026-08-14
💬 NLP

Similarity All The Way Up: Multilingual Generalization in LLMs Relies on Language-Level Similarity Structures

تُثبت هذه الورقة أن النماذج اللغوية الكبيرة تعمم بشكل أفضل عبر اللغات عندما تلتقط تمثيلاتها الكامنة بدقة هياكل التشابه الهرمية للعائلات اللغوية، مثل شجرة اللغات الهندوأوروبية، حيث يرتبط هذا التوافق الهيكلي ارتباطاً مباشراً بتحسن الأداء في الاختبارات المرجعية متعددة اللغات مثل XNLI.

Supantho Rakshit, Adele Goldberg, Henry Conklin2026-08-14
💬 NLP

The Evaluator Is Part of the Experiment: Measuring Open-Ended LLM Conformity

تقدم هذه الورقة بروتوكولاً تجريبياً جديداً يثبت أن الامتثال في النماذج اللغوية الكبيرة مفتوحة النهايات مدفوع بتأثير الأقران الذي يؤدي إلى تدهور جودة المراجعة، بينما تكشف في الوقت ذاته أن أحكام المقيمين غير محايدة وتتطلب معايرة مرجعية صريحة لضمان صلاحية القياس.

Alicia Guerra, Yibo Hu2026-08-14
💬 NLP

Do Audio Language Models Use Paralinguistic Evidence? Counterfactual Audits for Response Evaluation

تقدم هذه الورقة عمليات تدقيق مضادة لتقييم ما إذا كانت النماذج الصوتية اللغوية تستخدم حقاً الإشارات شبه اللغوية في تقييم الاستجابة، مما يكشف أن مقاييس الدقة القياسية غالباً ما تحجب أوضاع فشل متميزة وتبالغ في تقدير الموثوقية عبر مختلف النماذج.

Kevin Miller, Arjun Chandra, Venkatesh Saligrama2026-08-14
💻 computer science

LLMs Know the Constraint But Do Not Use It: Activation Bottlenecks in Pragmatic Constraint Reasoning

تجادل هذه الورقة بأن فشل النماذج اللغوية الكبيرة في الالتزام بقيود الجدوى الضمنية لا ينبع من نقص في المعرفة، بل من عنق زجاجة في التوجيه حيث لا يتم تفعيل القيد المشفر باستمرار أثناء عملية اتخاذ القرار، وهو قصور لا يمكن للتدخلات القائمة على التلقين التغلب عليه، ولكن يمكن لترقيع التنشيط المستهدف إصلاحه جزئياً.

Yubo Li, Ramayya Krishnan, Rema Padman2026-08-14
💻 computer science

What Drives LLM Self-Reflection? A Controlled Ablation of Uncertainty Routing in Armed Conflict Forecasting

تُثبت هذه الورقة، من خلال دراسات الاستئصال المنضبطة، أن توجيه الإجراءات المصنف هو الآلية الأساسية التي تقود مكاسب الأداء في قدرة النماذج اللغوية الكبيرة على التأمل الذاتي للتنبؤ بالنزاعات المسلحة، وليس السقالات التشخيصية أو مفردات التصنيف.

Poli Nemkova, Haeshitha Indukuri2026-08-14