💻 computer science

SOLAR: A Self-Optimizing Open-Ended Autonomous Agent for Lifelong Learning and Continual Adaptation

تقدم الورقة البحثية SOLAR، وهو وكيل ذاتي التحسين يعتمد على التعلم التلوي على مستوى المعلمات والتعلم التعزيزي متعدد المستويات للتغلب على النسيان الكارثي وتكاليف التكيف العالية، مما يمكّن النماذج اللغوية الكبيرة من التعلم المستمر والتكيف مع البيئات الديناميكية غير المستقرة من خلال قاعدة معرفية متطورة لاستراتيجيات التعديل.

Nitin Vetcha, Dianbo Liu2026-05-21
💬 NLP

Improving Quantized Model Performance in Qualitative Analysis with Multi-Pass Prompt Verification

تقترح هذه الدراسة طريقة تحقق من المطالبات متعددة المراحل واعية بالكمية للتخفيف من الهلوسة وعدم الاستقرار في نماذج LLaMA-3.1 المكممة ذات البتات المنخفضة، مما يثبت أنه بينما تتطابق نماذج 8 بت بشكل أفضل مع الحقيقة الأرضية المرمزة بشرياً، فإن التقنية المقترحة تعزز بشكل كبير دقة وموثوقية النماذج ذات البتات الأقل (4 بت، و3 بت، و2 بت) من أجل الأبحاث النوعية منخفضة التكلفة.

Aisvarya Adeseye, Jouni Isoaho, Adeyemi Adeseye2026-05-21
💬 NLP

Parallel LLM Reasoning for Bias-Resilient, Robust Conceptual Abstraction

تقترح هذه الورقة إطاراً هيكلياً يجمع بين المعالجة المتوازية على مستوى الأجزاء والدمج المرتكز على الأدلة للحد بشكل كبير من التحيز التحليلي، وأخطاء الحذف، والادعاءات غير المدعومة في النماذج اللغوية الكبيرة عند تحليل المستندات الطويلة، مما يعزز بشكل خاص أداء النماذج الأصغر حجماً.

Aisvarya Adeseye, Jouni Isoaho, Adeyemi Adeseye2026-05-21
💻 computer science

Evaluating multimodal emotion recognition in proactive conversational agents: A user study

تكشف هذه الدراسة المستخدمة لوكيل تفاعلي اجتماعيًا مدفوع بالذكاء الاصطناعي التوليدي والاستباقي أن التحليل اللغوي يتفوق على التعرف على الوجه في اكتشاف عواطف المستخدم بسبب تأثير "الوجه الجامد" السائد، ومع أن قدرة النظام على استثارة عواطف محددة فعالة، إلا أنها تعوقها الاستباقية غير المعايرة التي تهدد بانفصال المستخدم.

Adnana Dragut, Raquel Lacuesta, F. Xavier Gaya-Morey, Jose M. Buades-Rubio2026-05-21
💬 NLP

Long-Context Reasoning Through Proxy-Based Chain-of-Thought Tuning

تقدم الورقة البحثية ProxyCoT، وهو إطار تدريب يعزز الاستدلال في السياقات الطويلة لدى النماذج اللغوية الكبيرة من خلال نقل مسارات سلسلة الأفكار عالية الجودة المستمدة من سياقات وسيطة قصيرة إلى تسلسلات كاملة الطول عبر الضبط الدقيق الخاضع للإشراف، مما يحقق أداءً فائقاً مع تقليل التكاليف الحسابية وقدرة قوية على التعميم خارج النطاق.

Miao Li, Irina Saparina, Alexander Gurung, Mirella Lapata2026-05-21
💬 NLP

Under Pressure: Emotional Framing Induces Measurable Behavioral Shifts and Structured Internal Geometry in Small Language Models

تُظهر هذه الدراسة أن المحفزات ذات الإطار العاطفي تُحدث تحولات سلوكية ملموسة وأنماط تمثيل داخلي متميزة ومنظمة في النماذج اللغوية الصغيرة، مما يكشف عن اتجاهات تحكم حساسة للمحفزات دون الإيحاء بوجود حالات عاطفية جوهرية.

Rana Muhammad Usman2026-05-21
💻 computer science

GrandGuard: Taxonomy, Benchmark, and Safeguards for Elderly-Chatbot Interaction Safety

تقدم الورقة البحثية GrandGuard، وهو أول إطار عمل شامل يتكون من تصنيف ثلاثي المستويات، ومعيار مرجعي يضم 10,404 عنصرًا، وضمانات متخصصة لتحديد وتخفيف مخاطر السلامة الخاصة بكبار السن في تفاعلات النماذج اللغوية الكبيرة التي تغفلها تدابير السلامة العامة الحالية.

Changxuan Fan, Xi Yang, Yueyuan Zheng, Bin Zhou, Yuanping Wang, Wenbin Hu, Huihao Jing, Ki Sen Hung, Dazhao Du, Haoran L (…)2026-05-21
💻 computer science

PrivacyAkinator: Articulating Key Privacy Design Decisions by Answering LLM-Generated Multiple-choice Questions

تقدم هذه الورقة PrivacyAkinator، وهي أداة تفاعلية تستفيد من الأسئلة متعددة الخيارات التي تولدها النماذج اللغوية الكبيرة لمساعدة المطورين المبتدئين على صياغة قرارات تصميم الخصوصية الرئيسية بكفاءة وفعالية أكبر من منهجية تقييم مخاطر الخصوصية (PRAM) المعقدة الخاصة بالمعهد الوطني للمعايير والتقنية (NIST).

Qiyu Li, Yuen Sum Wong, Yuen Kei Wong, Longxuan Yu, Haojian Jin2026-05-21
💻 computer science

AI-Assisted Competency Assessment from Egocentric Video in Simulation-Based Nursing Education

تقدم هذه الورقة إطار عمل للذكاء الاصطناعي مكوناً من ثلاث مراحل يحلل فيديوهات محاكاة التمريض من منظور الشخص الأول لتقييم كفاءة المتعلم، مما يكشف عن ارتباط سلبي غير متوقع حيث يُظهر الطلاب ذوو الأداء العالي تدفقات عمل أكثر تنوعاً وصعوبة في التصنيف، مما يشير إلى أن عدم اليقين في التعرف يمكن أن يعمل كإشارة تربوية قيمة إلى جانب الجداول الزمنية للأفعال.

Hanchen David Wang, Yilin Liu, Madison J. Lee, Surya Chand Rayala, Gautam Biswas, Daniel T. Levin, Meiyi Ma2026-05-21
🤖 machine learning

Geometry-Lite: Interpretable Safety Probing via Layer-Wise Margin Geometry

تقدم هذه الورقة Geometry-Lite، وهو مسبار قابل للتفسير يفكك إشارات السلامة عبر طبقات المحولات (transformer layers) ليكشف أن الكشف عن سلامة مستوى المطالبة (prompt-level safety detection) يعتمد بشكل أساس أساسي على هندسة الهامش المستمرة عبر الطبقات وتحديد المواقع الحدودية بدلاً من إشارات الحركة من طبقة إلى أخرى.

Woo Seob Sim, Yu Rang Park2026-05-21