💬 NLP

Towards Robust Real-World Spreadsheet Understanding with Multi-Agent Multi-Format Reasoning

تقدم الورقة البحثية SpreadsheetAgent، وهو إطار عمل متعدد الوكلاء يتكون من مرحلتين يتغلب على قيود التعامل مع الجداول الحسابية كنصوص مجردة والتعامل مع المقاييس الضخمة من خلال التفسير التدريجي للمناطق المحلية عبر الاستدلال متعدد الوسائط والتحقق، محققاً أداءً هو الأفضل في فئته على معايير قياس الجداول الحسابية.

Houxing Ren, Mingjie Zhan, Zimu Lu, Ke Wang, Yunqiao Yang, Haotian Hou, Hongsheng Li2026-04-15
💬 NLP

The Enforcement and Feasibility of Hate Speech Moderation on Twitter

يكشف تدقيق عالمي لمنصة تويتر أنه على الرغم من الجدوى التقنية والاقتصادية للحد بشكل كبير من خطاب الكراهية من خلال مسارات الإشراف البشرية والمدعومة بالذكاء الاصطناعي، فإن إنفاذ المنصة الحالي غير فعال إلى حد كبير بسبب خيارات تخصيص الموارد المؤسسية بدلاً من القيود التقنية.

Manuel Tonneau, Dylan Thurgood, Diyi Liu, Niyati Malhotra, Victor Orozco-Olvera, Ralph Schroeder, Scott A. Hale, Manoel (…)2026-04-15
🤖 AI

Frontier-Eng: Benchmarking Self-Evolving Agents on Real-World Engineering Tasks with Generative Optimization

تقدم الورقة البحثية Frontier-Eng، وهو معيار مرجعي تم التحقق منه بشرياً ويضم 47 مهمة هندسية ذات مستوى صناعي لتقييم قدرة النماذج اللغوية الرائدة على تحسين التصاميم بشكل تكراري من خلال حلقات (اقترح-نفذ-قيم) مع تغذية راجعة مستمرة وقيود صارمة، مما يكشف أنه بينما يتصدر نموذج Claude 4.6 Opus، إلا أن تحديات كبيرة لا تزال قائمة وأن التحسن يتبع قانون القوة المزدوج المتناقص في كل من التكرار والحجم.

Yizhe Chi, Deyao Hong, Dapeng Jiang, Tianwei Luo, Kaisen Yang, Boshi Zhang, Zhe Cao, Xiaoyan Fan, Bingxiang He, Han Hao (…)2026-04-15
💬 NLP

CompliBench: Benchmarking LLM Judges for Compliance Violation Detection in Dialogue Systems

تقدم هذه الورقة CompliBench، وهو معيار جديد ومسار مؤتمت لتوليد البيانات مصمم لتقييم وتحسين قدرة نماذج الحكم القائمة على النماذج اللغوية الكبيرة (LLMs) على اكتشاف وتحديد مواقع انتهاكات الامتثال في أنظمة الحوار المؤسسية، كاشفةً عن معاناة النماذج الحالية مع هذه المهمة، بينما تُظهر في الوقت ذاته أن النماذج صغيرة النطاق التي تم ضبطها بدقة باستخدام البيانات المُخلّقة تحقق أداءً فائقاً وقدرة أفضل على التعميم.

Jingbo Yang, Guanyu Yao, Bairu Hou, Xinghan Yang, Nikolai Glushnev, Iwona Bialynicka-Birula, Duo Ding, Shiyu Chang2026-04-15
💬 NLP

Masked by Consensus: Disentangling Privileged Knowledge in LLM Correctness

تتقصى هذه الورقة ما إذا كانت النماذج اللغوية الكبيرة تمتلك معرفة داخلية متميزة حول صحة الإجابة، حيث كشفت أنه في حين أن التمثيلات الذاتية لا تقدم أي ميزة في المعايير القياسية بسبب الاتفاق العالي بين النماذج، إلا أنها توفر تفوقاً في مجالات محددة في المهام الواقعية مقارنة بالنماذح النظيرة عند تقييمها على مجموعات فرعية من حالات عدم الاتفاق، على عكس الاستدلال الرياضي.

Tomer Ashuach, Liat Ein-Dor, Shai Gretz, Yoav Katz, Yonatan Belinkov2026-04-15
🤖 machine learning

Nemotron 3 Super: Open, Efficient Mixture-of-Experts Hybrid Mamba-Transformer Model for Agentic Reasoning

إنّ Nemotron 3 Super هو نموذج هجين من نوع Mamba-Transformer Mixture-of-Experts، مفتوح المصدر، بـ 120 مليار معلمة، تم تدريبه مسبقاً باستخدام NVFP4 مع طبقات LatentMoE وMTP، محققاً إنتاجية عالية ودعماً لسياق يصل إلى مليون رمز مع مطابقة دقة النماذج الرائدة.

NVIDIA, :, Aakshita Chandiramani, Aaron Blakeman, Abdullahi Olaoye, Abhibha Gupta, Abhilash Somasamudramath, Abhinav Kh (…)2026-04-15
💬 NLP

Cooperative Memory Paging with Keyword Bookmarks for Long-Horizon LLM Conversations

تقترح هذه الورقة البحثية "التصفح التعاوني" (cooperative paging)، وهي استراتيجية لإدارة الذاكرة للمحادثات طويلة الأمد مع النماذج اللغوية الكبيرة، حيث تستبدل المحتوى المُطرود بحد أدنى من علامات المرجعية للكلمات المفتاحية وأداة استدعاء، محققةً بذلك أفضل جودة إجابة في اختبار LoCoMo المرجعي، بينما تكشف في الوقت ذاته أن الصفحات ثابتة الحجم والخشنة وخصوصية العلامات المرجعية المميزة أمران حاسمان لفعالية الاسترجاع.

Ziyang Liu2026-04-15
💬 NLP

SCRIPT: A Subcharacter Compositional Representation Injection Module for Korean Pre-Trained Language Models

تقدم الورقة البحثية SCRIPT، وهو وحدة برمجية مستقلة عن النموذج تعمل على حقن المعرفة التركيبية للوحدات الفرعية للحروف (Jamo) في النماذج اللغوية الكورية سابقة التدريب لتعزيز أدائها في مهام فهم اللغة الطبيعية (NLU) وتوليد اللغة الطبيعية (NLG)، مع التقاط التنظيمات النحوية والدلالية بشكل أفضل دون الحاجة إلى تغييرات هيكلية أو تدريب مسبق إضافي.

SungHo Kim, Juhyeong Park, Eda Atalay, SangKeun Lee2026-04-15
💬 NLP

Latent-Condensed Transformer for Efficient Long Context Modeling

تقدم هذه الورقة البحثية "انتباه التكثيف الكامن" (LCA)، وهو أسلوب غير مرتبط ببنية محددة يعمل على التحسين المشترك للكفاءة الحسابية وتقليل ذاكرة التخزين المؤقت لـ (KV cache) لنمذجة السياق الطويل، وذلك عبر تكثيف السياق مباشرةً داخل الفضاء الكامن لـ "الانتباه الكامن متعدد الرؤوس" (MLA) من خلال التجميع المدرك للاستعلام واختيار المرتكزات، مما يحقق تسريعاً كبيراً وتوفيراً في الذاكرة دون المساس بالأداء.

Zeng You, Yaofo Chen, Qiuwu Chen, Ying Sun, Shuhai Zhang, Yingjian Li, Yaowei Wang, Mingkui Tan2026-04-15
💬 NLP

Beyond Single-Dimension Novelty: How Combinations of Theory, Method, and Results-based Novelty Shape Scientific Impact

تحلل هذه الدراسة 15,322 مقالاً من مجلة "نيتشر كوميونيكيشنز" (Nature Communications) لتثبت أنه في حين توجد تكوينات حداثة متعددة الأبعاد، فإن الأوراق البحثية التي تتميز بالحداثة القائمة على النتائج فقط تحقق تأثيراً استشهادياً أعلى بكثير من تلك التي تجمع بين الحداثة النظرية والمنهجية وحداثة النتائج.

Yi Zhao, Yang Chenggang, Yuzhuo Wang, Tong Bao, Zhang Heng, Chengzhi Zhang2026-04-15