💬 NLP

Back to the Future: The Role of Past and Future Context Predictability in Incremental Language Production

من خلال دراستين للكلام الطبيعي، تُثبت هذه الورقة أن مقياساً معلوماتياً كمياً يقيس المعلومات المشتركة بين كلمة وسياقها المستقبلي (المقيد بالماضي) لا يفسر التباين الفريد في الاختزال الصوتي فحسب، بل يعمل أيضاً كأقوى مؤشر لأخطاء الاستبدال، مما يسلط الضوء على كيفية دمج المتحدثين ديناميكياً بين السياق الماضي والمستقبلي أثناء التخطيط المعجمي المتزايد.

Shiva Upadhye, Richard Futrell2026-04-24
💬 NLP

Tuning for TraceTarnish: Techniques, Trends, and Testing Tangible Traits

تقيم هذه الورقة هجوم التنميط الأسلوبي العدائي "TraceTarnish" من خلال تحديد السمات اللغوية الرئيسية — وتحديداً ترددات الكلمات الوظيفية والكلمات المحتوية ونسبة النوع إلى الرمز — التي تعمل كدلالات على الاختراق للكشف عن تعمية التأليف، وكعناصر أساسية لتعزيز فعالية الهجوم.

Robert Dilworth2026-04-24
💬 NLP

Entropy Ratio Clipping as a Soft Global Constraint for Stable Reinforcement Learning

تقترح هذه الورقة البحثية "قص نسبة الإنتروبيا" (Entropy Ratio Clipping - ERC)، وهو قيد عالمي ناعم يعمل على تثبيت التعلم التعزيزي للنماذج اللغوية الكبيرة من خلال فرض حدود ثنائية الاتجاه على نسبة الإنتروبيا بين السياسات الحالية والسابقة للتخفيف من حدة انزياح التوزيع وعدم استقرار التدريب.

Zhenpeng Su, Leiyu Pan, Minxuan Lv, Tiehua Mei, Zijia Lin, Yuntao Li, Wenping Hu, Ruiming Tang, Kun Gai, Guorui Zhou2026-04-24
💬 NLP

SocraticKG: Knowledge Graph Construction via QA-Driven Fact Extraction

تُعد SocraticKG طريقةً مؤتمتة لبناء الرسوم البيانية للمعرفة، حيث تستفيد من أزواج الأسئلة والأجوبة الموجهة بأسلوب (5W1H) كتمثيل وسيط لتفكيك دلالات الوثائق بشكل منهجي، مما يؤدي إلى حل المقايضة بين التغطية الواقعية والتجزئة العلاقاتية مع تعزيز قدرات الاستدلال متعدد الخطوات.

Sanghyeok Choi, Woosang Jeon, Kyuseok Yang, Taehyeong Kim2026-04-24
💬 NLP

GerAV: Towards New Heights in German Authorship Verification using Fine-Tuned LLMs on a New Benchmark

تقدم هذه الورقة GerAV، وهو معيار شامل للتحقق من التأليف باللغة الألمانية يضم أكثر من 400 ألف زوج نصي مصنف من تويتر وريديت، وتُظهر أن النماذج اللغوية الكبيرة التي تم ضبطها بدقة تتفوق بشكل كبير على النماذج المرجعية الحالية ونموذج GPT-5، مع الكشف عن وجود مقايضة بين التخصص والتعميم عبر مجالات البيانات المختلفة.

Lotta Kiefer, Christoph Leiter, Sotaro Takeshita, Elena Schmidt, Steffen Eger2026-04-24
💬 NLP

Automating Computational Reproducibility in Social Science: Comparing Prompt-Based and Agent-Based Approaches

تُظهر هذه الدراسة أن أنظمة الذكاء الاصطناي القائمة على الوكلاء تتفوق بشكل كبير على النهج القائم على الأوامر النصية في التشخيص التلقائي للأعطال الحسابية وإصلاحها في أبحاث العلوم الاجتماعية، محققةً معدلات نجاح في إعادة الإنتاج تتراوح بين 69 و96% مقارنة بـ 31 إلى 79% للأساليب القائمة على الأوامر النصية.

Syed Mehtab Hussain Shah, Frank Hopfgartner, Arnim Bleier2026-04-24
💬 NLP

Intent Laundering: AI Safety Datasets Are Not What They Seem

تكشف هذه الورقة أن مجموعات بيانات سلامة الذكاء الاصطناعي المستخدمة على نطاق واسع معيبة لأنها تعتمد على "إشارات تحفيزية" صريحة بدلاً من السلوك العدائي الواقعي، مما يثبت أنه عند إزالة هذه الإشارات عبر تقنية تسمى "غسيل النوايا"، تفشل حتى النماذج رفيعة المستوى في منع المخرجات الضارة.

Shahriar Golchin, Marc Wetter2026-04-24
💻 computer science

SPIRE: Structure-Preserving Interpretable Retrieval of Evidence

إنَّ SPIRE هو إطار عمل للاسترجاع يحافظ على البنية للمستندات التي بتنسيق HTML شبه المنظمة، حيث يعمل على تحسين جودة الاستشهاد وقابلية التفسير من خلال فهرسة المستندات الفرعية ذات البنية الشجرية وتطبيق آليات السياق العالمي والمحلي، متفوقاً بذلك على النماذج المرجعية التقليدية القائمة على التجزئة المسطحة في مهام الإجابة على الأسئلة.

Mike Rainey, Umut Acar, Muhammed Sezer2026-04-24
💻 computer science

Association Is Not Similarity: Learning Corpus-Specific Associations for Multi-Hop Retrieval

تقدم هذه الورقة البحثية طريقة "إعادة الترتيب المعززة بالارتباط" (AAR)، وهي طريقة إعادة ترتيب خفيفة الوزن ومخصصة للمتن، تعمل على تحسين أداء الاسترجاع متعدد القفزات بشكل كبير من خلال تعلم العلاقات الارتباطية بين الفقرات عبر التعلم التبايني، مما يثبت أن أنماط التواجد المشترك المحددة هذه أكثر فعالية في الاستدلال المعقد من التشابه الدلالي العام.

Jason Dury2026-04-24