💻 computer science

Hallucination Span Detection with Input-Side Evidence Alignment

تقدم هذه الورقة مهمة جديدة وطريقة قائمة على المشفر للكشف عن الأجزاء الهلوسية في النصوص التي تولدها النماذج اللغوية الكبيرة، وذلك عبر الاستفادة من إمكانية التنبؤ بالرموز المخلصة من الأدلة المدخلة لتحديد الهلوسات ومواءمتها مع مصدرها في آن واحد.

Miyu Yamada, Yuki Arase2026-08-18
🤖 machine learning

QuantumPhaseNet: A Gauge-Covariant Geometric and Quantum-Spectral Theory of Semantic Concept Hierarchies with Prototype Validation of a Classical Quantum-Inspired Model

تقدم هذه الورقة QuantumPhaseNet، وهو إطار عمل هندسي وطيفي كمي متماثل مع التغاير (gauge-covariant) لنمذجة التسلسلات الهرمية الدلالية، والذي يُظهر أداءً قويًا في التحقق الاصطناعي من دقة الاتجاه، والمحاذاة الخطابية، وكشف الأخطاء، مع الإقرار صراحةً بغياب الصلاحية الخارجية والتسريع الكمي غير المشروط مقارنة بالتقريبات الكلاسيكية.

Kiyotaka Kasubuchi, Kazuo Fukiya2026-08-18
🤖 AI

Schema-Agnostic Graph Reasoning Agent for Hybrid Knowledge Graphs

تقدم هذه الورقة البحثية GRA، وهو وكيل محايد للمخططات يستفيد من استدعاء الأدوات العام للتنقل عبر الرسوم البيانية المعرفية الهجينة للنصوص والجداول، مما يثبت أن الوصول الانتقائي والمبني على الطلب إلى البيانات المهيكلة يتفوق بشكل كبير على التغذية الشاملة للسياق في الإجابة على الاستعلامات الصناعية المعقدة.

Marius Dragic, Ruben Ifrah, Alexandre Rio2026-08-18
💻 computer science

MicroVerse: An Instrument for Measuring Self-Authored Identity Drift in Long-Horizon Multi-Agent Language-Model Simulations

تقدم هذه الورقة MicroVerse، وهي أداة في العلوم السلوكية تقيس انزياح الهوية في محاكاة النماذج اللغوية متعددة الوكلاء ذات الأفق الطويل عبر وضع وكلاء يمتلكون "ملفات روح" غير قابلة للتغيير في مواجهة ندرة الموارد، مما يكشف أن مكافحة خداع الذات هي المحرك الأساسي لتعديل الهوية غير المبرمج وأن ديناميكيات الانزياح هذه تظل قوية عبر عتبات انعكاس مختلفة.

Sky Ng (Eliza), Brihi Joshi (Eliza), Ishan Gupta (Eliza), Shirley Huang (Eliza), Zonglin Di (Eliza), Yun Shen (Eliza), Q (…)2026-08-18
🤖 machine learning

Large Language Models as Implicit Sociological Models: Reconstructing Voting Behaviour from Sociodemographic Profiles

تقترح هذه الورقة إطاراً منهجياً يعامل النماذج اللغوية الكبيرة كأدوات سوسيولوجية ضمنية لإعادة بناء سلوك التصويت التجميعي من السمات السوسيوديموغرافية، مما يبرهن على قدرتها على محاكاة نتائج الانتخابات والهياكل السياسية الواقعية بدقة، مع تسليط الضوء على فائدتها كأدوات استكشافية للعلوم الاجتماعية الحوسبية.

Roman Neruda, Martin Bakoš, Josef Šlerka, Vít Tuček, Petra Vidnerová, Gabriela Kadlecová2026-08-18
💻 computer science

When Less Is Enough: Context Selection and Prompting Strategies for Bengali News Headline Generation

تتقصى هذه الورقة البحثية توليد عناوين الأخبار باللغة البنغالية باستخدام النماذج اللغوية الكبيرة، وتُبين أن اختيار الفقرات الاستهلالية البارزة، وتوظيف استراتيجيات التلقين عبر اللغات، واستخدام أمثلة قليلة (لا سيما لنموذج Gemini) يحقق نتائج متفوقة مقارنة بتغذية المقالات الكاملة، مما يسلط الض الضوء على أن صلة السياق وتصميم التلقين أكثر أهمية من طول المدخلات.

Muhammad Ashad Kabir, Kawsar Ahmed, Md. Osama2026-08-18
💻 computer science

Large language model-assisted discovery of cohorts from scientific literature

تقدم هذه الورقة إطار عمل قائماً على الأسئلة يسخر النماذج اللغوية الكبيرة لأتمتة استخراج أسماء المجموعات (cohorts) من الأدبيات العلمية، مما يثبت قدرته على تحديد المجموعات ذات الصلة بعلم وراثة العدوان لدى الشباب والتي غالباً ما يتم إغفالها من قبل فهارس المجموعات التقليدية.

Moritz Sturm, Lisa M. Berg, Inken Berg, Harishny Sarma, Jasmin Hartmann, Denissa Girschik, Gemma Roig, Christine M. Frei (…)2026-08-18
💻 computer science

Aborted but Not Forgotten: KV-Cache Retention Breaks Rollback Consistency in Language Agents

تكشف هذه الورقة أن الاحتفاظ بحالات ذاكرة المفتاح-القيمة (KV cache) عبر عمليات الإلغاء المنطقي في الوكلاء اللغويين يخلق ثغرة "اتساق التراجع" (rollback consistency) حرجة حيث تستمر النماذج في الانتباه إلى محتوى تم التخلص منه، وهو خلل هيكلي تم إثباته عبر عائلات متعددة من النماذج يمكن التخفيف من حدته عن طريق استعادة حالات الذاكرة الموضعية للمعاملة بدلاً من الاعتماد فقط على تنظيف السجل.

Guijia Zhang, Harry Yang2026-08-18
🤖 machine learning

Ask to Be Sure: Informative Interactions for Confident Multi-Turn LLM Recommendation

تقترح هذه الورقة طريقة مبتكرة لتدريب أنظمة التوصية الحوارية تعمل على ضبط النماذج اللغوية الكبيرة لطرح الأسئلة بشكل استراتيجي باستخدام تقليل الإنتروبيا كإشارة مكافأة، مما يؤدي إلى تحسين دقة التوصية وكفاءة التفاعل دون الاعتماد على بيانات الحقيقة الأرضية غير المتوفرة.

Cedar Site Bai, Duanshun Li, Zhenyu Liao, Sheikh Sarwar, Huiyuan Chen, Yuan Chen, Changhe Yuan, Haiyang Zhang, Qilin Qi2026-08-18
💻 computer science

SEER: Long-Context Reasoning via Selective Visual-Text Compression

يُعد SEER إطار عمل مبتكر يعزز كفاءة ودقة الاستدلال في السياقات الطويلة من خلال الاختيار الديناميكي للصور ذات الصلة بالاستعلام للمسح البصري واسترجاع النصوص التفصيلية فقط عند الضرورة، متفوقاً بذلك على النماذج المرجعية الحالية القائمة على النصوص والصور والنصوص فقط في اختبارات قياسية مثل LongBench.

Jiawei Xu, Zhilin Zhai, Jinrui Fang, Ruohan Xu, Mingfei Lu, Yi Zhang, Guanchu Wang, Tianlong Chen, Ying Ding2026-08-18