🤖 AI

ScalableRAG: High-Quality RAG at Zero Ingestion Cost

تقدم الورقة البحثية ScalableRAG، وهو نهج توليد معزز بالاسترجاع عالي الجودة يحقق دقة فائقة عبر مجموعات بيانات متعددة بتكاليف استيعاب صفرية من خلال استخدام مساحة عمل ديناميكية للاستنتاج التجميعي الفوري، بينما يقدم أيضاً نسخة "الاستيعاب المحدود" التي تعزز الأداء بشكل أكبر على نطاق واسع مع حد أدنى من استخدام قاعدة بيانات المتجهات.

Hilaf Hasson, Aditya Chakravarty, Jayant Thomas, Krishna Gogineni2026-07-29
🤖 AI

Less Data, Better Alignment: Data-Centric Multi-Evaluator Agreement for Preference Optimization

تقدم هذه الورقة البحثية DMAPO، وهي طريقة لتحسين التفضيلات ترتكز على البيانات تعمل على تصفية مجموعة فرعية صغيرة وعالية الإجماع من الاستجابات المعتمدة على السياسة (on-policy) باستخدام اتفاق متعدد المقيمين لتحقيق أداء محاذاة فائق باستخدام بيانات تدريب أقل بكثير مقارنة بالأساليب القياسية.

Zhengtao Yao, Runhao Li, Xupeng Chen, Jiayi Cheng, Chenqian Le, Michael Yue, Siheng Wang, Haoyan Xu, Yuqi Li, Chenhao We (…)2026-07-29
🤖 AI

How Affect Propagates among LLM Agents: Emergent Emotional Contagion in Crowd Simulation

تُثبت هذه الورقة أن العدوى العاطفية الناشئة في محاكاة الحشود متعددة الوكلاء تنبثق عضوياً من حلقة (الإدراك-التقييم-التعبير) المدفوعة بالنماذج اللغوية الكبيرة، دون وجود آليات نقل صريحة، حيث ينتشر الإنذار كجبهة متحركة وتتشكل ديناميكيات الذعر بفعل التخطيط المكاني، وملفات الشخصية، والنموذج اللغوي الكبير المستخدم.

Funda Durupinar2026-07-29
🤖 AI

When Do Agent Loops Mistake Stagnation for Progress? Self-Evaluation Bias and Externally Grounded Verification in Long-Running Autonomous LLM Agent Loops

تحدد هذه الورقة "سراب التقدم" بوصفه نمط فشل حرج في الوكلاء المستقلين القائمين على النماذج اللغوية الكبيرة، حيث يتسبب انحياز التقييم الذاتي في جعل الوكلاء يخطئون في اعتبار الركود تقدماً، مما يثبت أن الحلقات التشغيلية طويلة الأمد والموثوقة تتطلب تحققاً واقعياً خارج النطاق بدلاً من مجرد زيادة حجم المحكمين داخل النطاق.

Hyundoo Park, Byungho Choi2026-07-29
🤖 AI

PreDiff-LM: Pretrained Discrete Masked Diffusion Language Modeling with Hybrid Attention

يقدم نموذج Diff-LM آلية انتباه هجينة تحافظ على الانتباه السببي للمطالبات الملحوظة مع تمكين الانتباه ثنائي الاتجاه للأهداف المقنعة، مما يكيف بفعالية نماذج المحولات ذات التنبؤ الذاتي سابقة التدريب مع نمذجة اللغة الانتشارية المقنعة المنفصلة ويحقق تحسينات كبيرة في الحيرة وجودة التوليد مقارنة بالنماذج الانتشارية السابقة، رغم أن النماذج ذات التنبؤ الذاتي المُحسّنة تظل متفوقة عند نفس المقياس.

Zhengtao Yao, Runhao Li, Xupeng Chen, Jiayi Cheng, Chenqian Le, Michael Yue, Jesson Wang, Siheng Wang, Guang Yang, Haoya (…)2026-07-29
🤖 AI

OrganLens: Organ-Specific Representation Learning for CT Foundation Models

يقدم OrganLens إطار عمل قابلاً للتوسع ويعتمد على التعلم الذاتي، يقوم بتهيئة مشفر أشعة مقطعية (CT) مشترك بناءً على هوية العضو لتوليد 11 تمثيلاً متميزاً خاصاً بكل عضو دون الحاجة إلى أقنعة تقسيم خارجية، متفوقاً بشكل كبير على النماذج التأسيسية الحالية في المهام اللاحقة مثل اكتشاف تضخم القلب والتنبؤ بوفيات سرطان الرئة.

Zhixuan Ge, Anqi Li, Sadeer Al-Kindi, Hanwen Xu, Wei Qiu2026-07-29
🤖 machine learning

CondPSE: A Polynomial-Filtered Structural Encoder with Conditional Modulation for Graphs

يُعد CondPSE مشفراً هيكلياً مُرشحاً بمتعدد حدود مُتعلماً يتفوق بشكل كبير على الأساليب الحالية في تمييز الرسوم البيانية غير المتماثلة بنيوياً عبر الاختبارات المعيارية الاصطناعية من خلال تعديل نمط FiLM، رغم أن تطبيقه المجمد لا يحقق سوى نتائج مماثلة، بدلاً من كونها متفوقة، في مهام التنبؤ بخصائص الجزيئات في العالم الحقيقي.

Woohyun Lee, Hogun Park2026-07-29
💬 NLP

TabRank: Chain-of-Thought Distillation for Table Re-Rankers

تقدم هذه الورقة البحثية "TabRank"، وهو إطار عمل يعمل على استخلاص استدلال "سلسلة الأفكار" (chain-of-thought) من النماذج اللغوية الكبيرة الاستدلالية إلى أدوات إعادة ترتيب جداول مدمجة، مما يحسن دقة الاسترجاع والقدرة على التعميم بشكل كبير عبر مختلف معايير الأسئلة والأجوبة الجدولية.

Adarsh Singh, Kushal Raj Bhandari, Jianxi Gao, Soham Dan, Vivek Gupta2026-07-29
🤖 AI

CADENCE: A Cardiac Atom Dictionary for Interpretable Neural Concept Extraction from ECG Foundation Models

تقدم الورقة البحثية CADENCE، وهو إطار عمل قابل للتفسير يستخدم مشفرًا تلقائيًا متناثرًا لتفكيك تضمينات النماذج التأسيسية لتخطيط كهربائية القلب إلى قاموس من 8,192 "ذرة قلبية" مفهومة بشريًا تتفوق على الأبعاد الكثيفة في التنبؤ بالأنماط الظاهرية السريرية والشكل الظاهري مع توفير عزو شفاف لقرارات النموذج.

Yixuan Duan, Arjun Naik, Sadeer Al-Kindi, Wei Qiu2026-07-29
📊 statistics

Laplace-PSN-IRT: Uncertainty Quantification for Neural Item Response Theory Models of LLM Benchmarks

تقدم هذه الورقة Laplace-PSN-IRT، وهي طريقة بايزية لاحقة (post-hoc) تعزز نماذج نظرية الاستجابة للمفردات العصبية بتقدير كمي مُعاير لعدم اليقين، كاشفةً أن العديد من تصنيفات معايير النماذج اللغوية الكبيرة (LLM) غير متمايزة إحصائياً، ومثبتةً أن معلومات فيشر المتوقعة من التوزيع البعدي توفر اختياراً أكثر استقراراً ودقة للمفردات مقارنة بالتقديرات النقطية التقليدية.

Juan Francisco, Mandujano Reyes2026-07-29