🤖 AI

Theory-Guided Deception Detection: A RAG-Based Artificial Intelligence Exploration

تقيم هذه الدراسة سبعة نماذج من نماذج التوليد المعزز بالاسترجاع (RAG) القائمة على نظريات الخداع مقابل نماذج مرجعية عبر 700 عبارة، لتجد أنه في حين أثرت المنظورات النظرية بشكل كبير على انحياز الاستجابة، إلا أنها لم تحسن دقة الكشف، والتي ظلت مماثلة للأداء البشري المعتاد وغير قابلة للتمييز إحصائياً بين نهجي الـ RAG والنماذج المرجعية.

David M. Markowitz, Timothy R. Levine2026-08-11
🔬 physics

Towards an LLM-based method for quantifying the sexual content in song lyrics

تقدم هذه الورقة طريقة قابلة للتكرار تعتمد على النماذج اللغوية الكبيرة لقياس المحتوى الموضوعي في كلمات الأغاني، وتطبقها على مجموعة بيانات مكونة من 1,259 مساراً من موسيقى الريغيتون لتحليل الصراحة الجنسية عبر الفنانين، والزمن، ومقارنةً بتصنيفات "سبوتيفاي" للمحتوى الصريح.

Ignacio M. Sticco2026-08-11
💬 NLP

Investigating Multimodal Informativity under Different Partner Visibility Conditions in Video-Mediated Dialogue

تتقصى هذه الورقة كيفية نقل الإيماءات والكلام معاً للمعلومات المرجعية في الحوار عبر الفيديو تحت ظروف رؤية متفاوتة، مظهرةً أن الإيماء وحدها تكون تنبؤية، وأن الدمج متعدد الوسائط يكون أكثر فائدة عندما يكون الكلام غامضاً، كما تؤثر رؤية الشريك على كل من إنتاج الإيماء والتدفق التفاعلي.

Esam Ghaleb, Hugh Mee Wong, Kristina Kobrock2026-08-11
💬 NLP

ELICITED: EHR-grounded Longitudinal Interactive Conversations for Information-seeking Triage Evaluation and Decision-making

تقدم هذه الورقة البحثية EHR2Dial-Triage، وهو إطار عمل ومعيار مرجعي جديد مستند إلى MIMIC-IV-ED، يقوم بتوليد محادثات تفاعلية مقيدة زمنياً لتقييم وتحسين قدرة نماذج الذكاء الاصطناعي على إجراء البحث الديناميكي عن المعلومات، والاستدلال القائم على الأدلة، واتخاذ القرار من أجل فرز حالات أقسام الطوارئ.

Haohao Zhu, Xiaolin Shi, Jiayu Zhou2026-08-11
💬 NLP

Measuring the Tokenization Premium: A Cost Audit for Underserved Language Communities

تقدم هذه الورقة "تدقيق عدالة التجزئة" (TEA) لتوضيح أن عدم كفاءة عملية تجزئة الرموز (tokenization) تخلق عوائق اقتصادية ووظيفية كبيرة للمجتمعات اللغوية غير المخدومة، مما يكشف أن المحتوى بلغات مثل البنغالية واليوربا يتطلب رموزاً أكثر بـ 4.5 مرة مقارنة بالإنجليزية، مما يقلل بشكل حاد من نوافذ السياق الفعالة ويزيد التكاليف.

Avijit Roy, Proma Roy, Hrishitva Patel2026-08-11
💬 NLP

Security and Privacy Taxonomy Generation from Mobile App Reviews

تقدم هذه الورقة TaxoScale، وهو مسار معالجة قابل للتوسع يقوم بتصفية أكثر من 600,000 مراجعة لتطبيقات الهاتف المحمول ويستخدم التجميع الهرمي المتكرر المدمج مع التسمية القائمة على النماذج اللغوية الكبيرة لإنشاء تصنيف شامل وجديد للأمن والخصوصية تلقائيًا، متجاوزًا بذلك قيود الطرق الحالية التي تواجه صعوبة في التعامل مع مجموعات البيانات الضخمة.

Moghis Fereidouni, Vinaik Chhetri, Umar Farooq, A. B. Siddique2026-08-11
💬 NLP

The Announcement Carries the Cue: Markup, Boundaries, and the Notation of Pre-Training Corpora

تجادل هذه الورقة بأن وجود الإعلانات الهيكلية، وليس تدوينها المحدد، هو المتغير الحاسم الذي يؤثر على سلوك النموذج في مجموعات بيانات ما قبل التدريب، وتقترح تنسيقاً جديداً للبيانات يفصل هذه الإعلانات إلى "مقصورات جانبية" (sidecars) قابلة للعكس مع إعطاء الأولوية لخيارات التنسيق المدفوعة بالقدرة على حساب الحفاظ على الدقة.

E. M. Freeburg2026-08-11
💬 NLP

Evo-Bench: Can Language Models Improve Agent Harness?

تقدم هذه الورقة "إيفو-بنش" (Evo-Bench)، وهو أول معيار مصمم لعزل وتقييم القدرة الجوهرية للنماذج اللغوية على تطوير أطر تشغيلها ذاتياً، مما يكشف عن مكاسب كبيرة في الأداء وهياكل استدلال قابلة للنقل، مع تسليط الضوء على التحديات الخاصة بمجالات معينة في المهام التي تتطلب سير عمل دقيق للغاية.

Lisheng Huang, Chen Yang, Hao Zhou, Huatong Song, Zongchao Chen, Ran Le, Yang Song, Wayne Xin Zhao, Tao Zhang2026-08-11
💬 NLP

LexKairos: Benchmarking Legal Temporal Capabilities in LLMs

تقدم هذه الورقة LexKairos، وهو معيار شامل مصمم لتقييم القدرات الزمنية للنماذج اللغوية الكبيرة في السياق القانوني الصيني عبر المعرفة التشريعية، ونمذجة القضايا، والاستنتاج، مما يكشف أن حتى النماذج الأعلى أداءً لا تزال تعاني في المهام القانونية الدقيقة والحساسة للوقت.

Chenyang Li, Zejia Feng, Yuqin Huang, Yuxiao Ye, Huiyuan Xie2026-08-11
💬 NLP

Subjective Multi-Bias Detection with Large Language Models

تقدم هذه الورقة مشروعاً يستخدم النماذج اللغوية الكبيرة للكشف عن ثلاثة أنواع من الانحيازات الذاتية -التأطير، والإبستمولوجي، والديموغرافي- وتصنيفها في النصوص، وذلك بالاستفادة من مجموعة بيانات WIKIBIAS التي تضم أكثر من 4,000 زوج من تعديلات ويكيبيديا لتحديد المواقف والتشويهات غير اللائقة.

Ruiyu Li, Zhiying Zhu2026-08-11