💬 NLP

Leveraging Human Reading Behavior for Keyphrase Extraction: A Webcam-based Eye-tracking Corpus

تقدم هذه الدراسة مجموعة بيانات تتبع حركة العين الصينية للغة المكتوبة (CLIS-ET)، وتثبت أن دمج ميزات تتبع حركة العين خفيفة الوزن القائمة على كاميرا الويب، ولا سيما عدد التثبيتات وإجمالي مدة التثبيت، يحسن بشكل كبير أداء استخراج العبارات المفتاحية من الملخصات الأكاديمية الصينية.

Chengzhi Zhang, Xinyi Yan, Wenqi Yu2026-08-12
💬 NLP

Can Released LLM Vocabularies Support Token-Level Estimation of Hidden Corpora?

تقدم هذه الورقة تقدير الكثافة الموجه بالكميات (QGDE)، وهي طريقة تستفيد من استقرار توزيعات نسب معرفات الرموز (token ID-ratio) في أجهزة ترميز BPE الصادرة لتقدير نسب التكوين بدقة لمجموعات بيانات التدريب المسبق الخفية على مستويي الرمز والفئة.

Qingjie Zhang, Xingzhang Ren, Zixuan Chen, Jinfeng Li, YueFeng Chen, Yitong Yang, Hui Xue, Dayiheng Liu, Han Qiu2026-08-12
💬 NLP

EVIL-Detect for NLPCC 2026 Shared Task 6: LLM-Generated Text Detection

تقدم هذه الورقة البحثية EVIL-Detect، وهو إطار عمل تجميعي متعدد الإشارات مع دمج واعٍ بالصراع، والذي حقق المركز الأول في المهمة المشتركة 6 لـ NLPCC 2026 من خلال الكشف الفعال عن النصوص المولدة بواسطة النماذج اللغوية الكبيرة، والمكتوبة بشرياً، والمعدلة بواسطة النماذج اللغوية الكبيرة في السيناريوهات الصينية.

Hongrui Bao, Hangyu Rong, Zhuoshang Wang, Yubing Ren, Yanan Cao2026-08-12
🤖 machine learning

Your LLM, Your Style: Behavioral Mode Axes for LLM Behavioral Control

تقدم هذه الورقة إطار عمل للبيانات السلوكية الموقعية ومحاور الأنماط السلوكية (BMAs) لتوصيف وتوجيه الأنماط السلوكية للنماذج اللغوية الكبيرة بشكل يمكن التحكم فيه من خلال اتجاهات فضاء التنشيط المستمدة من آثار التفاعل التبايني، مما يثبت أن النزعات الشخصية الخاصة بالنموذج مستقرة، وتعتمد على السياق، ويتم التقاطها بفعالية أكبر عبر آليات قائمة على التفكير بدلاً من الآليات القائمة على الاستجابة.

Haoze Liu, Run Liu, Haiying Xu, Jiahui Han, Siyuan Fang, Siyu Yan, Huiqi Deng, Guanchu Wang, Na Zou2026-08-12
💬 NLP

DuplexWorld: Can voice agents help you get through the day?

تقدم الورقة البحثية DuplexWorld، وهو معيار شامل يضم ستة مجالات من العالم الحقيقي و156 سيناريو لتقييم وكلاء الصوت من الكلام إلى الكلام بشكل شمولي بناءً على مقاييس المحادثة والتحليل والطبيعية، مما يكشف عن فجوات كبيرة في الأداء في الأنظمة الحالية رغم تزايد اعتمادها.

Aryan Vijay Bhosale, Harshit Rajgarhia, Akhil Pothanapalli, Asif Shaik, Abhishek Mukherji, Dinesh Manocha2026-08-12
💬 NLP

FaithformBench: Benchmarking Faithfulness of Mathematical Chain-of-Thought Autoformalisation

تقدم الورقة البحثية FaithformBench، وهو معيار مرجعي فعال من حيث التكلفة وسليم لتقييم مدى أمانة أنظمة الصياغة الرياضية الآلية، كاشفاً أن العديد من النماذج تظهر سلوك "التملق" عبر التصحيح الصامت للمدخلات غير الصالحة إلى عبارات قابلة للإثبات، مما يسلط الضوء على وجود توتر بين الحفاظ على الصحة والحفاظ على عدم الصلاحية.

Rob Cornish, Iacopo Ghinassi, Po-Hung Yeh, Shuqi Liu, Qiyuan Xu, Haoxuan Yin, Dominik Wagner, Wenda Li, Yee Whye Teh, Lu (…)2026-08-12
💬 NLP

REAP: Relation-Aware Elicitation and Parsing for Closed-Book Knowledge Base Construction from LLMs

حقق نظام REAP، المبني على نموذج Mistral بـ 24 مليار معلمة دون ضبط دقيق، درجة macro-F1 تبلغ 0.62 في مهمة AKBC المشتركة لعام 2026 من خلال توظيف تسلسل استدلال مهيكل، واستعلامات خاصة بالعلاقات، وبوابة مجموعة فارغة قائمة على الاستدلال لاستخلاص وتحليل المعرفة البارامترية إلى مصفوفات JSON صالحة.

Thanh-Dan Bui, Thanh-Trung Do, Tuan-Phong Nguyen2026-08-12
💬 NLP

ReLTEx: Reliable LLM-based Taxonomy Expansion

تقدم الورقة البحثية إطار عمل ReLTEx، الذي يعزز موثوقية والتماسك الدلالي لتوسيع التصنيفات القائم على النماذج اللغوية الكبيرة من خلال الجمع بين توليد المرشحين والتحقق المستند إلى البنية والتحكم في التوسع المتكرر للتخفيف من الهلوسة وعدم الاتساق الهرمي.

Zeinab Ghamlouch, Mehwish Alam2026-08-12
💬 NLP

MUSE: A Full-Text Cross-Domain Knowledge Base of Scientific Problems, Solutions, and Rationales

تقدم هذه الورقة MUSE، وهي قاعدة معرفية كاملة النص وعابرة للمجالات تحتوي على 37,000 ثلاثية (مسألة-حل-تعليل) منسقة من قبل خبراء ومستمدة من الأدبيات العلمية، والتي تُظهر أن تدريب النماذج اللغوية الكبيرة باستخدام إشراف التعليل يعزز الأداء في المسائل المعقدة متعددة القيود بينما قد يعيقه في المسائل الأبسط.

Tsofia Cohen, Tom Hope2026-08-12
💬 NLP

What Iterated Self-Feeding Probes of Language Models Measure, and a test that separates the construction from the model

تقدم هذه الورقة اختباراً صارماً للتمييز بين المصنوعات المتأصلة في بناء المسبار (مثل انتشار الضرر الحركي) والخصائص الحقيقية للنموذج (مثل أسات ليابونوف) في تجارب نماذج اللغة ذات التغذية الراجعة المتكررة، كاشفةً أن الادعاءات السابقة بوجود تحولات طورية كانت غالباً ما تُنسب خطأً إلى النماذج بدلاً من المنهجية.

Nicolás Vera Zúñiga2026-08-12