💬 NLP

The Path of Least Resistance: Guiding LLM Reasoning Trajectories with Prefix Consensus

تقدم الورقة البحثية PoLR، وهي طريقة فعالة حوسبياً أثناء الاستنتاج تعمل على تجميع بادئات الاستدلال لتحديد وتوسيع المسارات الأكثر واعدة فقط، مما يحقق دقة تضاهي طريقة "الاستمرارية الذاتية" (Self-Consistency) مع تقليل استخدام الرموز (tokens) وزمن الاستجابة بشكل كبير دون الحاجة إلى ضبط النموذج.

Ishan Jindal, Sai Prashanth Akuthota, Jayant Taneja, Sachin Dev Sharma2026-02-04
💬 NLP

Are you going to finish that? A Practical Study of the Partial Token Problem

تتقصى هذه الورقة البحثية "مشكلة الرمز الجزئي" (partial token problem)، حيث تُثبت أن المطالبات الواقعية التي تنتهي في منتصف الرمز الرمزي — لا سيما في اللغات التي لا تعتمد على المسافات البيضاء، واللغات التركيبية، والبرمجة — تسبب تشوهات حادة في الاحتمالية في النماذج اللغوية الكبيرة لا تتحسن مع زيادة الحجم، مع التحقق من فعالية الحلول الدقيقة عند الاستدلال.

Hao Xu, Alisa Liu, Jonathan Hayase, Yejin Choi, Noah A. Smith2026-02-04
💬 NLP

LegalOne: A Family of Foundation Models for Reliable Legal Reasoning

تقدم هذه الورقة LegalOne، وهي عائلة من النماذج التأسيسية القانونية الصينية التي تحقق أداءً هو الأفضل في فئتها من خلال خط إنتاج تدريبي ثلاثي المراحل يتكون من أخذ العينات المعدلة للمرونة، وتقطير سلسلة الأفكار الوكيل القانوني، والتعلم المعزز المنهجي لتمكين الاستدلال القضائي الموثوق والقابل للتفسير.

Haitao Li, Yifan Chen, Shuo Miao, Qian Dong, Jia Chen, Yiran Hu, Junjie Chen, Minghao Qin, Yueyue Wu, Yujia Zhou, Qingya (…)2026-02-04
💬 NLP

Wiki Live Challenge: Challenging Deep Research Agents with Expert-Level Wikipedia Articles

تقدم هذه الورقة تحدي "ويكي لايف" (Wiki Live Challenge)، وهو معيار مرجعي جديد يقيم وكلاء البحث العميق (Deep Research Agents) مقابل مقالات ويكيبيديا "المقالات الجيدة" (Good Articles) التي تم التحقق منها من قبل خبراء باستخدام إطار عمل صارم يتكون من 39 معياراً، مما يكشف عن فجوة أداء كبيرة بين الوكلاء الحاليين وجودة البحث على المستوى البشري.

Shaohan Wang, Benfeng Xu, Licheng Zhang, Mingxuan Du, Chiwei Zhu, Xiaorui Wang, Zhendong Mao, Yongdong Zhang2026-02-04
💬 NLP

WildGraphBench: Benchmarking GraphRAG with Wild-Source Corpora

تقدم هذه الورقة WildGraphBench، وهو معيار مرجعي جديد يستفيد من بنية المراجع غير المتجانسة في ويكيبيديا لتقييم أنظمة GraphRAG في مهام السياق الطويل الواقعية، كاشفةً أنه بينما تتفوق المسارات الحالية في تجميع الحقائق المتعددة، فإنها غالباً ما تعاني في التلخيص دقيق التفاصيل بسبب التركيز المفرط على العبارات رفيعة المستوى.

Pengyu Wang, Benfeng Xu, Licheng Zhang, Shaohan Wang, Mingxuan Du, Chiwei Zhu, Zhendong Mao2026-02-04
💬 NLP

Closing the Loop: Universal Repository Representation with RPG-Encoder

تقدم الورقة البحثية RPG-Encoder، وهو إطار عمل يوحد بين فهم المستودع وتوليده في تمثيل عالي الدقة وقابل للتوسع عبر ترميز الكود الخام إلى مخطط تخطيط مستودع ديناميكي (Repository Planning Graph)، مما يحقق أداءً هو الأفضل حالياً في تحديد موقع الكود وتغطية إعادة بناء شبه مثالية.

Jane Luo, Chengyu Yin, Xin Zhang, Qingtao Li, Steven Liu, Yiming Huang, Jie Wu, Hao Liu, Yangyu Huang, Yu Kang, Fangkai (…)2026-02-04
💬 NLP

AR-MAP: Are Autoregressive Large Language Models Implicit Teachers for Diffusion Large Language Models?

تقترح الورقة البحثية إطار عمل AR-MAP، وهو إطار عمل جديد لتعلم النقل يستفيد من النماذج اللغوية الكبيرة ذات التوليد الذاتي المتوافقة مع التفضيلات كمعلمين ضمنيين لمحاذاة نماذج Diffusion LLM بفعالية من خلال قياس بسيط للأوزان، مما يتجاوز التباين العالي والأعباء الحسابية للمحاذاة المباشرة مع تحقيق أداء متفوق.

Liang Lin, Feng Xiong, Zengbin Wang, Kun Wang, Junhao Dong, Xuecai Hu, Yong Wang, Xiangxiang Chu2026-02-04
💬 NLP

Interpreting and Controlling LLM Reasoning through Integrated Policy Gradient

تقدم هذه الورقة البحثية "تدرج السياسة المتكامل" (IPG)، وهو إطار عمل مبتكر يعزز قابلية التفسير والتحكم في استدلال النماذج اللغوية الكبيرة من خلال عزو المساهمات المتسلسلة إلى المكونات الداخلية عبر الانتشار العكسي للإشارات القائمة على النتائج، مما يتيح تحديد المواقع بدقة أكبر وضبط سلوكيات الاستدلال بشكل موثوق.

Changming Li, Kaixing Zhang, Haoyun Xu, Yingdong Shi, Zheng Zhang, Kaitao Song, Kan Ren2026-02-04
💬 NLP

The Hypocrisy Gap: Quantifying Divergence Between Internal Belief and Chain-of-Thought Explanation via Sparse Autoencoders

تقدم هذه الورقة البحثية "فجوة النفاق" (Hypocrisy Gap)، وهي مقياس ميكانيكي يستخدم المشفّرات التلقائية المتفرقة (Sparse Autoencoders) لقياس ورصد التباين بين الاستدلال الداخلي للنماذج اللغوية الكبيرة ومخرجاتها النهائية، مما يظهر أداءً فائقاً على المقاييس المرجعية للاحتمالية اللوغاريتمية في تحديد السلوكيات غير الأمينة مثل التملق والنفاق عبر نماذج متعددة.

Shikhar Shiromani, Archie Chaudhury, Sri Pranav Kunda2026-02-04
💬 NLP

Beyond Translation: Cross-Cultural Meme Transcreation with Vision-Language Models

تقدم هذه الورقة إطار عمل هجين للترجمة الإبداعية (transcreation) ومجموعة بيانات ضخمة للميمات الصينية والأمريكية لتقييم نماذج الرؤية واللغة في التكيف الثقافي المتبادل للميمات، كاشفةً أنه بينما تُظهر النماذج الحالية قدرة محدودة، فإنها تُظهر عدم تماثل اتجاهي كبير مع أداء متفوق في عملية الترجمة الإبداعية من الأمريكية إلى الصينية مقارنة بالعكس.

Yuming Zhao, Peiyi Zhang, Oana Ignat2026-02-04