💬 NLP

Does Local News Stay Local?: Online Content Shifts in Sinclair-Acquired Stations

تستخدم هذه الدراسة أساليب حوسبية لتوضيح أنه بعد استحواذ مجموعة "سينكلير برودكاست جروب" على محطات الأخبار المحلية، تحول هذه المحطات محتواها عبر الإنترنت لتغطية المزيد من المواضيع الوطنية المستقطبة على حساب القضايا المحلية.

Miriam Wanner, Sophia Hager, Anjalie Field2026-05-15
💬 NLP

TRIM: Token-wise Attention-Derived Saliency for Data-Efficient Instruction Tuning

يُعد TRIM إطار عمل فعال حاسبياًًا، يعمل في اتجاه واحد، يقوم ببناء مجموعات بيانات جوهرية عالية الجودة لضبط التعليمات من خلال الاستفادة من بصمات الانتباه على مستوى الرمز لتحديد العينات التمثيلية، متفوقاً بذلك على الطرق القائمة على التدرج والضبط الدقيق للبيانات الكاملة مع تقليل التكاليف الحسابية بشكل كبير.

Manish Nagaraj, Sakshi Choudhary, Utkarsh Saxena, Deepak Ravikumar, Kaushik Roy2026-05-15
💬 NLP

Prompting from the bench: Large-scale pretraining is not sufficient to prepare LLMs for ordinary meaning analysis

تجادل هذه الورقة بأن التدريب المسبق واسع النطاق وحده غير كافٍ لإعداد النماذج اللغوية الكبيرة للقيام بتحليل "المعنى العادي" القانوني بشكل موثوق، حيث تكشف الأدلة التجريبية أن استنتاجاتها تفتقر إلى المتانة تجاه التغييرات الطفيفة في الصياغة وتظهر ارتباطاً متوسطاً فقط مع الأحكام البشرية، مما يجعلها غير صالحة للاستخدام المرجعي في السياقات القضائية عالية المخاطر.

Abhishek Purushothama, Junghyun Min, Brandon Waldon, Nathan Schneider2026-05-15
💬 NLP

Native Parallel Reasoner: Reasoning in Parallelism via Self-Distilled Reinforcement Learning

تقدم الورقة البحثية "المستنتج المتوازي الأصلي" (NPR)، وهو إطار عمل خالٍ من المعلم يُمكّن النماذج اللغوية الكبيرة من تطوير قدرات استنتاج متوازية حقيقية ذاتياً من خلال التدريب التقدمي المستخلص ذاتياً، وتحسين السياسة المدرك للتوازي، ومحرك تنفيذ مُعاد هيكلته، محققاً مكاسب كبيرة في الأداء وتسريعات في الاستنتاج تصل إلى 4.6 ضعف دون العودة إلى فك التشفير التوليدي المتسلسل.

Tong Wu, Yang Liu, Jun Bai, Zixia Jia, Shuyi Zhang, Ziyong Lin, Yanting Wang, Song-Chun Zhu, Zilong Zheng2026-05-15
💬 NLP

Teaching and Evaluating LLMs to Reason About Polymer Design Related Tasks

تقدم هذه الورقة PolyBench، وهي مجموعة بيانات مرجعية واسعة النطاق تضم أكثر من 125,000 مهمة لتصميم البوليمرات معززة بالمعرفة الهيكلية، وتُظهر أن النماذج اللغوية الصغيرة المدربة باستخدام طريقة مبتكرة لتقطير الاستدلال المعزز بالمعرفة يمكنها التفوق على النماذج ذات الحجم المماثل ومنافسة النماذج اللغوية الكبيرة الرائدة في الاستدلال حول تصميم البوليمرات.

Dikshya Mohanty, Mohammad Saqib Hasan, Syed Mostofa Monsur, Size Zheng, Benjamin Hsiao, Niranjan Balasubramanian2026-05-15
💬 NLP

OPT-Engine: Benchmarking the Limits of LLMs in Optimization Modeling via Complexity Scaling

تقدم هذه الورقة OPT-Engine، وهو إطار عمل معياري قابل للتوسع لتقييم النماذج اللغوية الكبيرة في مهام نمذجة الأمثلة، كاشفةً أن النماذج الحالية تعاني من ضعف المتانة مع زيادة التعقيد، ومحددةً صياغة القيود المؤتمتة باعتبارها العائق الرئيسي أمام الاستدلال المتكامل مع الحلّال (solver).

Yitian Chen, Cheng Cheng, Yinan Sun, Zi Ling, Dongdong Ge2026-05-15
💬 NLP

FactNet: A Billion-Scale Knowledge Graph for Multilingual Factual Grounding

تقدم الورقة البحثية FactNet، وهو رسم بياني معرفي متعدد اللغات بمقياس المليارات يربط 1.7 مليار توكيد من Wikidata بأكثر من 3 مليارات مؤشر دليل بلغة أصلية من ويكيبيديا بدقة على مستوى البايت، إلى جانب مجموعة تقييم FactNet-Bench المصممة لتقييم وتحسين التأسيس الواقعي ونقل المعرفة عبر اللغات.

Yingli Shen, Wen Lai, Jie Zhou, Xueren Zhang, Yudong Wang, Kangyang Luo, Shuo Wang, Ge Gao, Alexander Fraser, Maosong Su (…)2026-05-15
💬 NLP

Do Reasoning LLMs Refuse What They Infer in Long Contexts?

تكشف هذه الورقة عن فجوة أمنية حرجة في نماذج اللغات الكبيرة ذات السياق الطويل، حيث تُظهر أنه بينما ترفض النماذج بفعالية الطلبات الضارة الصريحة، فإن معدلات رفضها تنخفض بشكل كبير عندما تكون الأهداف الضارة مخفية عبر قطع سياقية مجزأة تتطلب استدلالاً تركيبياً لإعادة بنائها.

Yu Fu, Haz Sameen Shahgir, Huanli Gong, Zhipeng Wei, N. Benjamin Erichson, Yue Dong2026-05-15
💻 computer science

A Hormone-inspired Emotion Layer for Transformer language models (HELT)

تقدم هذه الورقة البحثية HormoneT5، وهي بنية "ترانسفورمر" (transformer) مبتكرة تعزز الذكاء العاطفي في النماذج اللغوية من خلال دمج كتلة هرمونية مستوحاة بيولوجياً لمحاكاة حالات عاطفية مستمرة ومتعددة الأبعاد، مما يؤدي إلى استجابات أكثر تعاطفاً وملاءمةً من الناحية العاطفية مقارنة بالنماذج المرجعية.

Eslam Reda, Sara El-Metwally2026-05-15
💻 computer science

PREPING: Building Agent Memory without Tasks

تقدم هذه الورقة Preping، وهو إطار عمل يُمكّن الوكلاء من بناء الذاكرة الإجرائية قبل مواجهة المهام المستهدفة عبر استخدام حلقة موجهة من قِبل مُقترح لتوليد وتخزين مسارات ممارسة اصطناعية عالية الجودة بشكل انتقائي، مما يتغلب على فجوة البداية الباردة بتكاليف نشر أقل بكثير من بناء الذاكرة عبر الإنترنت.

Yumin Choi, Sangwoo Park, Minki Kang, Jinheon Baek, Sung Ju Hwang2026-05-15