💻 computer science

Analyzing Middle School Students' Dialogue and Behaviors during Collaborative AI Chatbot Development Using Ordered Network Analysis

تستخدم هذه الدراسة تحليل الشبكة المرتبة للكشف عن أن تطوير طلاب المدارس المتوسطة لروبوتات الدردشة الاصطناعية التعاونية يتميز بتسلسلات متكاملة من الشرح والاختبار والتحسين، والتي ترتبط إيجابياً بكل من جودة مخرجات روبوت الدردشة الأعلى ونتائج معرفة الذكاء الاصطناعي الأقوى.

Shan Zhang, Andres Felipe Zambrano, Xiaoyi Tian, Yukyeong Song, Anthony F. Botelho, Kristy Elizabeth Boyer, Maya Israel (…)2026-07-27
🤖 AI

AgentKVShift: Efficient KV Cache Reuse for Agentic Memory Systems

تُعد AgentKVShift طريقةً تعتمد على الاستقصاء ولا تتطلب تدريباً، حيث تُسرّع أنظمة الذاكرة الوكيلية بشكل كبير من خلال إعادة استخدام وتصحيح مخازن KV المؤقتة بكفاءة مع إعادة حساب 10-30% فقط من الرموز (tokens)، محققةً أداءً يقارب الأداء الكامل لإعادة الحساب وتسريعاً في مرحلة التعبئة المسبقة (prefill) يتراوح بين 2 إلى 3.5 ضعف عبر مختلف النماذج اللغوية الكبيرة والمقاييس المرجعية.

Nilesh Prasad Pandey, Jason Kong, Lanxiang Hu, Quanling Zhao, Yujie Zhao, Onat Gungor, Hao Zhang, Tajana Rosing2026-07-27
🤖 AI

Coupled Hierarchical Search over Topology and Execution for Agentic Workflow Synthesis

تُعد HierFlow بنية معمارية تعمل في وقت الاختبار ولا تتطلب تدريباً، حيث تقوم بأتمتة تخليق سير العمل الوكيل عبر توظيف نموذج بحث هرمي مقترن، يدمج ديناميكياً بين تعديلات الطوبولوجيا والتحسين على مستوى التنفيذ لتحقيق أداء وكفاءة فائقين عبر مختلف المعايير المرجعية.

Dong Li, Yanchi Liu, Xujiang Zhao, Wei Cheng, Zhengzhang Chen, Xintao Wu, Zhong Chen, Chen Zhao, Haifeng Chen2026-07-27
🤖 AI

SCOPE and SCION: A Benchmark and an Auditable Reference Pipeline for Schema Induction and Fusion from Text

تقدم هذه الورقة SCOPE، وهو معيار لتقييم استقراء المخططات من النصوص الخام، وSCION، وهو مسار مرجعي قابل للتدقيق يقوم ببناء ودمج مخططات الرسوم البيانية من بيانات التدريب، مما يظهر أداءً فائقاً على الخطوط المرجعية الحالية مع توفير مخرجات شفافة تماماً ومرتبطة بالأدلة.

Miaobo Hu, Xiaobo Guo, Shuhao Hu, Bokun Wang, Rui Chen, Xin Wang, Daren Zha, Jun Xiao2026-07-27
🤖 AI

Procedural Knowledge Is Not Low-Rank: Why LoRA Fails to Internalize Multi-Step Procedures

تُظهر هذه الورقة أن تقنية LoRA تفشل في استيعاب المعرفة الإجرائية المعقدة متعددة الخطوات بفعالية مقارنة بالضبط الدقيق الكامل، لأن تحديثات الأوزان الضرورية تُظهر رتبة فعالة عالية تتجاوز بكثير قدرة LoRA منخفضة الرتبة، مما يؤدي إلى فجوات كبيرة في الأداء حتى عند الرتب العالية.

Simon Dennis, Kevin Shabahang, Hao Guo, Rivaan Patil2026-07-27
🤖 AI

The Hard Decision Layer: Evidence for Committed Inference in Transformers

تحدد هذه الورقة وتتحقق من صحة "طبقة القرار الحازم" (HDL)، وهي خاصية بنيوية طبيعية في نماذج المحولات (transformer) حيث تستقر ترتيبات الإجابات بشكل مفاجئ أثناء الاستدلال، مما يؤدي إلى تحسينات كبيرة في الدقة ويقدم رؤى جديدة للاستدلال الفعال وتوجيه النماذج.

Ashwath Vaithinathan Aravindan, Mayank Kejriwal2026-07-27
🤖 AI

Household Movement Detection in Mixed-Format Occupancy Data Using LLM-Based Entity Resolution

تقترح هذه الورقة إطار عمل معززاً بالذكاء الاصطناعي يستفيد من التعرف على الكيانات القائم على النماذج اللغوية الكبيرة، والتضمينات الدلالية، والاستدلال الرسومي للكشف عن أنماط الحركة المنزلية غير المباشرة في بيانات الإشغال الصاخبة وذات التنسيقات المختلطة، مما يظهر تحسينات ملحوصة في استدعاء البيانات ودرجة F1 مقارنة بالنماذج المرجعية التقليدية الثنائية.

Sasirekha Oguri, John R. Talburt, Mert Can Cakmak2026-07-27
🤖 AI

FrED: External Data Influence Estimation via Domain Knowledge Graph Grounding

تقترح الورقة البحثية FrED، وهو إطار عمل احتمالي جديد من نوع "الصندوق الأسود" لنسب البيانات، يدمج أوجه التشابه في الميزات المستمرة مع الرسوم البيانية للمعرفة الخاصة بالمجال لتوفير تقدير كفء، وقابل للتفسير، ومرتكز بنيوياً للتأثير عبر مجالات معقدة مثل التركيب الفني والتنبؤ بالطقس.

Theodoros Aivalis, Iraklis A. Klampanos, Antonis Troumpoukis, Joemon M. Jose2026-07-27
🤖 AI

Lost in Context: Addressing Context Anxiety in Large Language Models

تحدد هذه الورقة وتدرس بشكل منهجي "قلق السياق" في النماذج اللغوية الكبيرة، كاشفةً أن إخفاقات الاستنتاج غالباً ما تنبع من الشك الذاتي المبكر والتقدير غير الدقيق للرموز (tokens) بدلاً من نقص القدرة، وتثبت أنه يمكن تحسين الأداء من خلال تعليم النماذج كيفية تقييم حدود قدراتها بشكل أفضل.

Ifueko Igbinedion, Jillian Ross, Etienne Ricardez, Sertac Karaman, Eric So2026-07-27
🤖 AI

Do VLMs Read or Rewrite? On Transcription Faithfulness in Vision-Language Models

تقدم هذه الورقة معيار FaithC4 لتوضيح أن نماذج الرؤية واللغة غالباً ما تعيد كتابة النصوص غير المكتملة إلى أشكال تبدو منطقية بدلاً من نسخها بأمانة، مما يكشف عن أنماط تدهور متميزة عبر أنواع النماذج ويحدد تمثيلات طبقات وكلمات محددة تحفز سلوك إعادة الكتابة هذا.

Gwang Gook Lee, Kenan Emir Ak, Jay Mohta, Yan Xu, Dimitrios Dimitriadis2026-07-27