💬 NLP

Using LLMs for Knowledge Component-level Correctness Labeling in Open-ended Coding Problems

تقترح هذه الورقة إطار عمل مؤتمتًا يستفيد من النماذج اللغوية الكبيرة لتوليد تسميات دقيقة لمكونات المعرفة المتعلقة بالصحة من أكواد الطلاب مفتوحة النهاية، مما يثبت أن هذا النهج ينتج منحنيات تعلم أكثر اتساقًا من الناحية المعرفية وأداءً تنبؤيًا محسنًا مقارنة بطرق التسمية التقليدية على مستوى المسألة.

Zhangqi Duan, Arnav Kankaria, Dhruv Kartik, Andrew Lan2026-03-31
💻 computer science

Bridge-RAG: An Abstract Bridge Tree Based Retrieval Augmented Generation Algorithm With Cuckoo Filter

يُعد Bridge-RAG إطار عمل جديداً للجيل المعزز بالاسترجاع يعمل على تعزيز أداء النماذج اللغوية الكبيرة من خلال استخدام بنية شجرة جسر تجريدية لتحسين الدقة الدلالية ومرشح كوكو (Cuckoo Filter) مُحسَّن مع قوائم مرتبطة كتلية لسرعة استرجاع أعلى بكثير، محققاً زيادة في الدقة بنسبة 15.65% وتسريعاً يتراوح من 10 إلى 500 ضعف مقارنة بالطرق الحالية.

Zihang Li, Wenjun Liu, Yikun Zong, Jiawen Tao, Siying Dai, Songcheng Ren, Zirui Liu, Yanbing Jiang, Tong Yang2026-03-31
💻 computer science

SRAG: RAG with Structured Data Improves Vector Retrieval

تقترح الورقة البحثية تقنية "الاسترجاع المعزز بالتوليد المهيكل" (SRAG)، وهي طريقة تعزز التوليد المعزز بالاسترجاع من خلال دمج البيانات الوصفية المهيكلة مثل المواضيع، والمشاعر، وثلاثيات الرسم البياني للمعرفة في الاستعلامات والقطع النصية، مما يؤدي إلى تحسن ذي دلالة إحصائية بنسبة 30% في جودة الإجابة، لا سيما بالنسبة للأسئلة التحليلية والتنبؤية المعقدة.

Shalin Shah, Srikanth Ryali, Ramasubbu Venkatesh2026-03-31
💬 NLP

GeoBlock: Inferring Block Granularity from Dependency Geometry in Diffusion Language Models

يُعد GeoBlock إطار عمل لا يتطلب تدريباً، يقوم بتحسين حجم الكتل ديناميكياً في نماذج اللغة الانتشارية من خلال تحليل هندسة التبعية المستمدة من الانتباه لتحقيق التوازن بين كفاءة فك التشفير المتوازي والموثوقية ذات الترتيب الذاتي.

Lipeng Wan, Junjie Ma, Jianhui Gu, Zeyang Liu, Xuyang Lu, Xuguang Lan2026-03-31
💬 NLP

AlpsBench: An LLM Personalization Benchmark for Real-Dialogue Memorization and Preference Alignment

تقدم هذه الورقة البحثية AlpsBench، وهو معيار مرجعي جديد مستمد من 2,500 حوار واقعي بين البشر والنماذج اللغوية الكبيرة (LLMs) مع ذكريات مهيكلة موثقة، لتقييم وكشف القيود الحرجة في النماذج الحالية فيما يتعلق باستخراج وتحديث واسترجاع واستخدام المعلومات الشخصية عبر دورة حياة الذاكرة الكاملة.

Jianfei Xiao, Xiang Yu, Chengbing Wang, Wuqiang Zheng, Xinyu Lin, Kaining Liu, Hongxun Ding, Yang Zhang, Wenjie Wang, Fu (…)2026-03-31
💻 computer science

LITTA: Late-Interaction and Test-Time Alignment for Visually-Grounded Multimodal Retrieval

إنَّ LITTA هو إطار عمل للمحاذاة في وقت الاختبار يعزز استرجاع المستندات متعدد الوسائط المرتكز بصرياً من خلال توليد متغيرات متعددة للاستعلام عبر نموذج لغوي كبير وتجميع نتائجها عبر دمج الرتب المتبادل، مما يحسن المتانة والدقة دون الحاجة إلى إعادة تدريب المسترجع.

Seonok Kim2026-03-31
💬 NLP

The Cognitive Divergence: AI Context Windows, Human Attention Decline, and the Delegation Feedback Loop

تضع هذه الورقة نظرية "التباعد المعرفي"، وهو ديناميكية تعزز نفسها حيث يؤدي النمو الأسي لنوافذ سياق الذكاء الاصطناعي والتراجع المتزامن في الانتباه البشري المستدام إلى خلق فجوة قدرات متسعة، مدفوعة بـ "حلقة تغذية راجعة للتفويض" يتم من خلالها تآكل القدرة المعرفية البشرية بشكل أكبر مع زيادة الاعتماد على الذكاء الاصطناعي.

Netanel Eliav (Machine Human Intelligence Lab)2026-03-31
💻 computer science

SEAR: Schema-Based Evaluation and Routing for LLM Gateways

إن SEAR هو نظام قائم على المخططات لبوابات النماذج اللغوية الكبيرة (LLM) يوحد بين التقييم والتوجيه عبر تعريف مخطط علاقي قابل للتوسيع لإشارات الجودة الدقيقة والمقاييس التشغيلية، مستفيداً من الاستدلال المدفوع بالنماذج اللغوية الكبيرة لتوليد بيانات مهيكلة تتيح توجيهاً دقيقاً، وقابلاً للتفسير، وفعالاً من حيث التكلفة لطلبات مقدمي الخدمات المتعددين.

Zecheng Zhang, Han Zheng, Yue Xu2026-03-31
💬 NLP

Do Multilingual VLMs Reason Equally? A Cross-Lingual Visual Reasoning Audit for Indian Languages

تقدم هذه الورقة أول تدقيق عابر للغات للاستدلال البصري لست لغات هندية، كاشفةً أن نماذج الرؤية واللغة متعددة اللغات تعاني من انخفاض كبير في الدقة وتظهر أداءً متدهوراً في سلسلة الأفكن في السياقات غير الإنجليزية، لا سيما بالنسبة للغات الدراويدية، مما يثبت أن التدريب المسبق متعدد اللغات الحالي يفشل في نقل قدرات الاستدلال البصري عبر الحدود اللغوية والخطية.

Swastik R2026-03-31
💬 NLP

LogicDiff: Logic-Guided Denoising Improves Reasoning in Masked Diffusion Language Models

تُعد LogicDiff طريقةً خالية من المعلمات وتعمل أثناء وقت الاستدلال، حيث تعزز بشكل كبير قدرات الاستنتاج لنماذج اللغة ذات الانتشار المقنع عبر استبدال عملية كشف الرموز القياسية القائمة على الثقة بجدولة موجهة منطقياً تعطي الأولوية للروابط المنطقية الحرجة، مما يؤدي إلى رفع الدقة في معايير GSM8K وMATH-500 دون الحاجة إلى إعادة تدريب النموذج.

Shaik Aman2026-03-31