💻 computer science

Improving Labeling Consistency with Detailed Constitutional Definitions and AI-Driven Evaluation

تقترح هذه الورقة سير عمل مدفوعاً بالذكاء الاصطناعي يستخدم النماذج اللغوية الكبيرة الرائدة لإنشاء "دساتير" مفصلة تغطي الحالات الحدية لفئات الإشراف على المحتوى، مما يثبت أن هذا النهج يتفوق بشكل كبير على الملحظين البشريين في اتساق ودقة التصنيف مع تقليل الخلاف بين النماذج بمقدار يصل إلى 57 ضعفاً.

Konstantin Berlin, Adam Swanda2026-05-26
💻 computer science

Faithfulness as Information Flow: Evaluating and Training Faithful Chain-of-Thought Reasoning

تقترح هذه الورقة إطار عمل لتدفق المعلومات الهيكلية لتقييم وتعزيز موثوقية "سلسلة الأفكار" (Chain-of-Thought) عبر تقديم تشخيصات قائمة على الإنتروبيا، و(masked-KL)، والتدرج، إلى جانب تدخلات في وقت التحديث مثل قناع الانتباه والاضطرابات العدائية التي تقلل بفعالية من سلوكيات الاختصار واختراق المكافأة في النماذج اللغوية.

Jinghan Jia, Joe Benton, Eric Easley2026-05-26
💬 NLP

End-to-End Intracortical Speech Decoding from Neural Activity

تُثبت هذه الورقة أن مُفكك شفرة عصبي يعتمد على نموذج "Conformer" من طرف إلى طرف، تم تدريبه مباشرة على تسجيلات داخل القشرة المخية لمشارك مصاب بتصلب جانبي عضلي (ALS) دون نماذج لغوية خارجية، يحقق فك تشفير كلامي ذو معنى على مستوى الحروف بنسبة خطأ في الحروف بلغت 23.80%، على الرغم من التحديات الناجمة عن تدهور الإشارة وتجزئة حدود الكلمات.

Owais Mujtaba Khanday, Jose A. Gonzalez-Lopez, Marc Ouellet, Alberto Galdon, Gonzalo Olivares Granados2026-05-26
💬 NLP

How Much Structure Do LLMs Need? Evaluating LLMs for Bibliometric Cluster Description

تقيم هذه الورقة مدى فعالية دمج الخوارزميات الببليومترية مع النماذج اللغوية الكبيرة لتوليف الأدبيات العلمية، حيث وجدت أنه في حين تواجه النماذج اللغوية الكبيرة صعوبة في استنتاج البنية بشكل مستقل، فإنها تتفوق في توليد أوصاف مقروءة للمجموعات عند تزويدها بهياكل مشتقة خوارزمياً وقابلة للتدقيق ضمن سير عمل هجين.

Abraham Camelo-Guerrero, Jairo Diaz-Rodriguez2026-05-26
💻 computer science

SliceWorld: A Predictive and Controllable World-State Model for CT Report Generation

يُعد SliceWorld إطار عمل مبتكر لحالة العالم مخصص للأشعة المقطعية، يقوم بنمذجة فحوصات الأشعة المقطعية المحورية كمتتاليات مرتبة للتنبؤ بالشرائح المستقبلية وتمكين توليد التقارير القابلة للتحكم عبر ترميز الأدلة البادئة في حالات كامنة مدركة للعوامل تمثل التشريح، والآفات، وعدم اليقين.

Yuanhe Tian, Yan Song2026-05-26
💬 NLP

Side-by-side Comparison Amplifies Dialect Bias in Language Models

تكشف هذه الورقة أن التحيز الخفي للهجات في النماذج اللغوية، والذي يربط الصور النمطية السلبية بإنجليزية سكان أمريكا من أصل أفريقي (AAVE)، يتفاقم بشكل كبير عند مقارنة الإنجليزية الأمريكية القياسية وتغريدات (AAVE) جنبًا إلى جنب، وهو اكتشاف يتحدى طرق التقييم وجهود التخفيف الحالية.

Kritee Kondapally, Claire J. Smerdon, Pooja C. Patel, Ogheneyoma Akoni, Jevon Torres, Jaspreet Ranjit, Matthew Finlayson (…)2026-05-26
💬 NLP

Temporal Concept Drift in Legal Judgment Prediction: Neural Baselines Across Three Epochs of Ukrainian Court Decisions

تكشف هذه الدراسة أن اللغة القانونية في القرارات القضائية الأوكرانية تشهد انزياحاً مفاهيمياً زمنياً كبيراً عبر العصور الجيوسياسية، مما يتسبب في تدهور حاد في أداء النماذج القياسية عند تطبيقها مستقبلاً، بينما تثبت أن التعلم المستمر الزمني والتدريب المسبق في المجال القانوني يمكن أن يخففا بفعالية من هذا الانزياح ويمنعا النسيان الكارثي.

Volodymyr Ovcharov2026-05-26
🤖 AI

AgentFugue: Agent Scaling for Long-Horizon Tasks through Collective Reasoning

تقدم الورقة البحثية AgentFugue، وهو إطار عمل للتفكير الجماعي يعزز أداء المهام طويلة الأمد من خلال ربط الوكلاء الأقران المتوازيين عبر مركز تفكير مشترك يسجل ويسهل إعادة استخدام الاكتشافات الوسيطة، مما يثبت أن التوسع الأفقي لأنظمة الوكلاء يمكن أن يحقق مكاسب نوعية في القدرات تتجاوز مجرد التوسع في الحوسبة.

Yuyang Hu, Hongjin Qian, Shuting Wang, Jiongnan Liu, Tong Zhao, Xiaoxi Li, Zheng Liu, Zhicheng Dou2026-05-26
🧬 biology

MindAlign: Bridging EEG, Vision, and Language for Zero-Shot Visual Decoding

يقدم MindAlign إطار عمل تبايني ثلاثي الأنماط يعمل على محاذاة التمثيلات الخاصة بتخطيط كهربية الدماغ (EEG)، والتمثيلات البصرية، والتمثيلات النصية من خلال عملية تدريب مسبق على مرحلتين ومحاذاة مشتركة، محققاً أداءً رائدًا في فك التشفير البصري لصفر من الأمثلة (zero-shot) على معيار Things-EEG2، مع إظهار قدرة قوية على التعميم وصلاحية فسيولوجية عصبية.

Zexuan Chen, Sichao Liu, Runhao Lu, Huichao Qi, Alexandra Woolgar, Xi Vincent Wang, Lihui Wang2026-05-26
🧬 biology

What Are We Actually Decoding? Source Attribution for Non-Invasive Brain-to-Language Retrieval

تقدم هذه الورقة إطاراً تدقيقياً لفك تشفير اللغة من الدماغ بطرق غير جراحية، يعمل على تفكيك مقاييس الأداء المتضخمة إلى مسارات هيكلية مختصرة، وأدلة مرتبطة بالمحفز، وتجميع سياقي، مبرهناً من خلال تدخل مبتكر لـ "تحيز سياق المجموعة" أن المكاسب المُبلغ عنها غالباً ما تكون مدفوعة بعوامل غير عصبية ويجب عزو مصادرها بدقة بدلاً من مجرد الإبلاغ عنها.

Xinyu Zhang, Sichao Liu, Runhao Lu, Alexandra Woolgar, Lihui Wang2026-05-26