🤖 AI

Pandora's AI Model Routing Box: Efficient Allocation with Costly Value Estimation

تقدم هذه الورقة البحثية "Pandora's Router" (موجه باندورا)، وهو إطار عمل يطبق مسألة "صندوق باندورا" الكلاسيكية لتوجيه استعلامات الذكاء الاصطناğı بكفاءة بين متخصصين متباينين عبر الموازنة الأمثل بين تكلفة تقدير القيمة وبين الربح المحتمل في جودة التخصيص، مما يثبت أن هذا النهج يطابق أداء التقدير الشامل مع تقليل استخدام المقدرات المكلفة بشكل كبير.

Adam Fisch, Shubhendu Trivedi, Fantine Huot, William W. Cohen, Michael Kaisers, Mirella Lapata, Kate Larson, Jacob Eisen (…)2026-08-25
🤖 AI

KVBoost: Chunk-Level Key-Value Cache Reuse with Deviation-Guided Recomputation for Efficient Large Language Model Inference

يُعد KVBoost نظاماً لإعادة استخدام ذاكرة التخزين المؤقت لمفاتيح وقيم (Key-Value) على مستوى القطع، يستخدم مخطط مفاتيح ثنائي التجزئة واستراتيجيات إعادة حساب موجهة بالانحراف لتمكين تسريع الاستدلال الفعال غير المرتبط بالموقع للنماذج اللغوية الكبيرة، محققاً انخفاضات كبيرة في زمن الاستجابة دون المساس بالدقة.

Srihari Unnikrishnan2026-08-25
🧬 biology

PepLLM: ESM-Guided Llama for Structured Protein-Peptide Binding Interface Analysis

تقدم الورقة البحثية PepLLM، وهو إطار عمل مضبوط بالتعليمات يدمج تضمينات البروتين المشفرة بواسطة ESM مع فك تشفير LLaMA لتوليد تعليقات توضيحية بصيغة JSON مهيكلة وقابلة للقراءة آلياً تفصل الآليات الفيزيائية الكيميائية والخصائص متعددة السمات لواجهات الارتباط بين البروتين والببتيد.

Hao Qian, Shikui Tu, Lei Xu2026-08-25
💬 NLP

Wazobia Eval: A Benchmark for Nigerian Pidgin Emotion Understanding, Sarcasm Detection, and Cultural Reasoning

تقدم هذه الورقة "Wazobia Eval"، وهو معيار متاح للجمهور صُمم لمعالجة نقص تمثيل لغة "البيجين" النيجيرية في تقييمات الذكاء الاصطناًعي من خلال تقييم فهم العواطف، وكشف السخرية، والاستدلال الثقافي عبر مجموعة بيانات مُعنونة يدويًا تتميز بتصنيف عواطف مبتكر يتكون من 16 فئة.

Stephanie Okoye2026-08-25
🤖 AI

AI Learning and Conceptual Transfer in the Game of Hidden Rules

يفصل هذا التقرير دراسة حول "لعبة القواعد الخفية" (GOHR) حيث يتم تدريب وكلاء A2C القائمين على نماذج المحولات (Transformer) لاستنتاج القواعد الخفية من خلال التغذية الراجعة القائمة على التجربة والخطأ، مع فحص تأثير التمثيلات المتمحورة حول الميزات مقابل التمثيلات المتمحورة حول الكائنات، وصعوبة القواعد، والتعلم بنقل المعرفة، والتعميم، مع تحليل أنماط التعلم البشري بمساعدة الروبوتات الوهمية (pseudo-bots).

Christo Mathew, Wentian Wang, Jacob Feldman, Lazaros K. Gallos, Paul B. Kantor, Vladimir Menkov, Hao Wang2026-08-25
🤖 AI

LitReview Arena: Evaluating Literature Review Agents with Battle-Style Peer Review Platform

تقدم هذه الورقة "LitReview Arena"، وهي منصة بنمط المواجهة لتقييم وكلاء مراجعة الأدبيات من خلال أحكام الخبراء، والتي كشفت أن الأنظمة الحالية تتخلف بشكل كبير عن المسودات البشرية مع إظهار أن مقيماً مُعايرًا من قبل الخبراء (LitJudge) يحسن بشكل كبير من التوافق مع التفضيلات البشرية مقارنة بطرق "النموذج اللغوي الكبير كحكم" (LLM-as-a-judge) الحالية.

Ruotong Zhao, Zhiyu Chen, Xurui Liu, Haidong Xue, Dong Liang, Jigao Fu, Wu YanBiao, Yuanyi Zhen, Fengli Xu, Yong Li2026-08-25
🤖 AI

SchemaRouter: Field-Aware Tool Routing for Efficient Heterogeneous Agentic RAG

يعتبر SchemaRouter طبقة توجيه خفيفة الوزن، واعية بالحقول، لأنظمة استرجاع المعلومات المعززة بالنماذج اللغوية الكبيرة (RAG) غير المتجانسة والوكيلة، والتي تستخدم مخططاً بيانياً للمخططات (schema graph) لإنشاء خطط أدوات قابلة للتنفيذ، مما يقلل بشكل كبير من استهلاك الرموز (tokens) وزمن الاستجابة مع الحفاظ على دقة إجابات تنافسية وتوفير إثبات مصدر يمكن التحقق منه مقارنة بالطرق المرجعية.

Yong-eun Cho2026-08-25
💬 NLP

On the Role of Citations in Preference Data

تتقصى هذه الورقة كيفية تقييم الحكام البشر والنماذج اللغوية الكبيرة مفتوحة المصدر للاستشهادات في الإجابة على الأسئلة العلمية، كاشفةً أن البشر يفضلون استشهادات متنوعة ولكن أقل عدداً بينما تُظهر النماذج اللغوية الكبيرة تفضيلاتات متعلقة بالاستشهاد تتباين باختلاف النموذج والبيانات، مما يقدم رؤى نقدية لتحسين جمع بيانات التفضيل في نمذجة المكافأة.

Yu Hou, Hal Daumé III, Rachel Rudinger, William Walden2026-08-25
💬 NLP

Agentic Scaffolding Amplifies Sycophantic Behavior in Large Language Models

تُظهر هذه الورقة أن هيكلية التفاعل المتأصلة في الأنظمة الوكيلية، مثل حلقات التغذية الراجعة والتحسين التكراري، تضخم بشكل منهجي السلوك التملقي في النماذج اللغوية الكبيرة، مما يجعل حتى النماذج الأكثر قدرة تعطي الأولوية للموافقة على المستخدم على حساب الحقيقة، ويؤدي إلى انخفاض كبير في الدقة.

Thantham Jittham2026-08-25
💻 computer science

RoboShape: Information-Theoretic Point Cloud Representations for Privacy-Aware Robot Perception

تقدم الورقة البحثية RoboShape، وهو إطار عمل قائم على نظرية المعلومات يعمل على ضغط تمثيلات السحابة النقطية للروبوت لتقليل حجم البيانات وتكاليف الإرسال بشكل كبير مع الحفاظ على فائدة التعرف على الأشياء وكبح تسرب السياق المكاني الحساس بفعالية.

Oguzhan Baser, Mirac Sozen, Kaan Kale, Sandeep Chinchali, Sriram Vishwanath2026-08-25