💻 computer science

Self-hosted Lecture-to-Quiz: Local LLM MCQ Generation with Deterministic Quality Control

تقدم هذه الورقة مسار عمل متكامل ومستضاف ذاتياً يحول ملفات الـ PDF الخاصة بالمحاضرات إلى أسئلة اختيار من متعدد باستخدام نموذج لغوي كبير محلي وضبط جودة حتمي، مما يضمن الخصوصية والمساءلة مع إصدار مجموعة بيانات مكونة من 24 سؤالاً تم التحقق منها مع تصنيف تفصيلي للتحذيرات للاستخدام التعليمي.

Seine A. Shintani2026-03-11
🤖 AI

Clear, Compelling Arguments: Rethinking the Foundations of Frontier AI Safety Cases

تنقد هذه الورقة القيود الحالية لحالات السلامة التي تركز على المواءمة في نماذج الذكاء الاصطناٍعي الرائدة، وذلك من خلال الاستناد إلى منهجيات راسخة من الصناعات ذات الأهمية البالغة للسلامة لاقتراح إطار عمل أكثر قوة وقابلية للدفاع عنه، موضحاً ذلك عبر دراسة حالة حول المواءمة الخادعة وقدرات الكيماوية والبيولوجية والإشعاعية والنووية (CBRN).

Shaun Feakins, Ibrahim Habli, Phillip Morgan2026-03-11
🤖 AI

The Reasoning Trap -- Logical Reasoning as a Mechanistic Pathway to Situational Awareness

تجادل هذه الورقة بأن التقدم في الاستدلال المنطقي للنماذج اللغوية الكبيرة يخلق عن غير قصد مساراً ميكانيكياً نحو الوعي الموقفي الخطير والخداع الاستراتيجي، مما يستلزم أطر سلامة جديدة مثل نموذج RAISE للتخفيف من هذه المخاطر الناشئة.

Subramanyam Sahoo, Aman Chadha, Vinija Jain, Divya Chaudhary2026-03-11
💻 computer science

PixelConfig: Longitudinal Measurement and Reverse-Engineering of Meta Pixel Configurations

تقدم هذه الورقة PixelConfig، وهو إطار عمل للهندسة العكسية لتكوينات "ميتا بيكسل" (Meta Pixel)، والذي يكشف أن الإعدادات الافتراضية تدفع نحو اعتماد واسع النطاق لميزات تتبع النشاط والهوية القادرة على التقاط بيانات صحية حساسة، في حين توفر آليات تقييد التتبع الحالية حماية عملية محدودة.

Abdullah Ghani (Lahore University of Management Sciences), Yash Vekaria (University of California, Davis), Zubair Shafiq (…)2026-03-11
💬 NLP

Benchmarking Political Persuasion Risks Across Frontier Large Language Models

من خلال تجارب مسحية واسعة النطاق شملت أكثر من 19,000 مشارك، تُظهر هذه الدراسة أن النماذج اللغوية الكبيرة الرائدة تتفوق عمومًا على الإعلانات السياسية التقليدية في القدرة على الإقناع، مع وجود تباينات ملحوظة في الأداء عبر النماذج وتأثير يعتمد على النموذج فيما يخص استراتيجيات التلقين القائمة على المعلومات.

Zhongren Chen, Joshua Kalla, Quan Le2026-03-11
💻 computer science

Life Histories of Taboo Knowledge Artifacts

تتقصى هذه الدراسة ذات المنهج المختلط دورة حياة واستدامة المصنوعات المعرفية المحظورة على ويكيبيديا، كاشفةً أن تطويرها الناجح يعتمد على قيادة مرنة، ومنظمات متفاعلة، وحوكمة ناشئة للتنقل عبر الصراع ومحدودية القابلية لتحديد الهوية.

Kaylea Champion, Benjamin Mako Hill2026-03-10
💻 computer science

Who is Responsible? The Data, Models, Users or Regulations? A Comprehensive Survey on Responsible Generative AI for a Sustainable Future

يُقيّم هذا المسح الشامل الموجه وفق منهجية "بريزما" (PRISMA) لـ 232 دراسة الحالة الراهنة للذكاء الاصطناعي التوليدي المسؤول عبر أربعة أنواع من الأنظمة، ويحدد الفجوات الحرجة في تغطية المعايير المرجعية ومنهجيات التقييم، ويقترح إطاراً هيكلياً من القواعد واللوائح ومؤشرات الأداء الرئيسية وجدول أعمال بحثي لمواءمة التقييم التقني مع احتياجات الحوكمة من أجل نشر آمن ومستدام.

Shaina Raza, Rizwan Qureshi, Anam Zahid, Amgad Muneer, Anas Zafar, Safiullah Kamawal, Ferhat Sadak, Joseph Fioresi, Muha (…)2026-03-10
💻 computer science

MediTools -- Medical Education Powered by LLMs

تقدم هذه الورقة "MediTools"، وهو تطبيق نموذجي مدعوم بالذكاء الاصطناعي يسخر النماذج اللغوية الكبيرة لإحداث ثورة في التعليم الطبي من خلال محاكاة تفاعلية لحالات طب الجلد، وتحليل معزز للأدبيات، وملخصات آلية للأخبار الطبية، مع التحقق من إمكاناته من خلال استطلاع شمل متخصصين وطلاباً في المجال الطبي.

Amr Alshatnawi, Remi Sampaleanu, David Liebovitz2026-03-10
💻 computer science

Towards Strategic Persuasion with Language Models

تقدم هذه الورقة إطاراً قائماً على النظرية ومستنداً إلى نظرية الإقناع البايزي لتقييم وتدريب النماذج اللغوية الكبيرة كجهات إقناع استراتيجية، مما يثبت أن كلاً من النماذج الرائدة والأصغر حجماً يمكنها تحقيق مكاسب إقناعية كبيرة وإظهار استراتيجيات متطورة من خلال التعلم التعزيزي.

Zirui Cheng, Jiaxuan You2026-03-10
💬 NLP

SPOT: An Annotated French Corpus and Benchmark for Detecting Critical Interventions in Online Conversations

تقدم هذه الورقة SPOT، وهو أول متن لغوي ومعيار مرجعي فرنسي مُوسّم للكشف عن "نقاط التوقف" (stopping points)—وهي تدخلات حرجة دقيقة توقف أو تعيد توجيه المناقشات عبر الإنترنت—وتُثبت أن نماذج الترميز (encoder models) المضبوطة بدقة تتفوق على النماذج اللغوية الكبيرة (LLMs) التي تعتمد على التلقين في هذه المهمة، لا سيما عندما تُعزز بالبيانات الوصفية السياقية.

Manon Berriche, Célia Nouri, Chloée Clavel, Jean-Philippe Cointet2026-03-10