💬 NLP

Construction of a Battery Research Knowledge Graph using a Global Open Catalog

تقدم هذه الورقة مساراً قابلاً للتوسع لبناء رسم بياني معرفي متمحور حول المؤلف لأبحاث البطاريات باستخدام OpenAlex واستخراج الكلمات المفتاحية المعزز بالنماذج اللغوية الكبيرة لتمكين تتبع الخبرات عبر المؤسسات، وكشف المجتمعات، وتحليل التشابه الدلالي بما يتجاوز الطرق التقليدية القائمة على الاستشهاد.

Luca Foppiano, Sae Dieb, Malik Zain, Kazuki Kasama, Keitaro Sodeyama, Mikiko Tanifuji2026-04-23
💬 NLP

Hybrid Policy Distillation for LLMs

تقدم هذه الورقة تقنية تقطير السياسة الهجين (HPD)، وهي إطار عمل موحد لتقطير المعرفة يدمج تباعدات KL الأمامية والعكسية مع مزيج من البيانات غير المتوافقة مع السياسة والبيانات المتوافقة مع السياسة التقريبية لتعزيز استقرار وكفاءة وأداء ضغط النماذج اللغوية الكبيرة عبر مهام متنوعة.

Wenhong Zhu, Ruobing Xie, Rui Wang, Pengfei Liu2026-04-23
💬 NLP

ActuBench: A Multi-Agent LLM Pipeline for Generation and Evaluation of Actuarial Reasoning Tasks

تقدم هذه الورقة البحثية "ActuBench"، وهو مسار عمل لنماذج اللغات الكبيرة متعددة الوكلاء يعمل على أتمتة توليد وتقييم مهام الاستدلال الاكتواري المتقدمة المتوافقة مع منهج الجمعية الدولية للعلوم الاكتوارية (IAA)، مما يثبت أن التحقق المستقل يحسن جودة العناصر بشكل كبير، ويكشف في الوقت ذاته أن النماذج ذات الأوزان المفتوحة والمستضافة محلياً توفر مقايضات متفوقة بين التكلفة والأداء، وأن التقييم مفتوح النهايات ضروري للتمييز بدقة بين قدرات النماذج رفيعة المستوى.

Jan-Philipp Schmidt2026-04-23
💬 NLP

Surrogate modeling for interpreting black-box LLMs in medical predictions

تقترح هذه الورقة إطار عمل للنمذجة البديلة يستخدم التلقين المكثف لتقريب وتفسير المعرفة الكامنة في النماذج اللغوية الكبيرة ذات الصندوق الأسود كمياً في التنبؤات الطبية، مما كشف بنجاح عن كل من التناقضات مع المعرفة الطبية الراسخة واستمرار التحيزات العرقية المفروضة علمياً لدعم نشر النماذج بشكل أكثر أماناً.

Changho Han (Medical Big Data Research Center, Seoul National University Medical Research Center, Seoul National Univers (…)2026-04-23
💬 NLP

Graph2Counsel: Clinically Grounded Synthetic Counseling Dialogue Generation from Client Psychological Graphs

تقدم الورقة البحثية Graph2Counsel، وهو إطار عمل يعمل على توليد حوارات استشارية اصطناعية عالية الجودة وذات أسس سريرية من خلال الاستفادة من الرسوم البيانية النفسية المنظمة للعملاء للتغلب على ندرة البيانات وقيود الخصوصية، مما أدى إلى إنشاء مجموعة بيانات تحسن بشكل كبير أداء النماذج اللغوية المضبوطة بدقة في معايير الاستشارة.

Aishik Mandal, Hiba Arnaout, Clarissa W. Ong, Juliet Bockhorst, Kate Sheehan, Rachael Moldow, Tanmoy Chakraborty, Iryna (…)2026-04-23
💬 NLP

Decoding Text Spans for Efficient and Accurate Named-Entity Recognition

تقدم الورقة البحثية SpanDec، وهو إطار عمل فعال لتعرف الكيانات المسماة القائم على النطاقات (span-based)، والذي يحسن المقايضة بين الدقة والكفاءة للتطبيقات واسعة النطاق والتطبيقات التي تعمل على الأجهزة من خلال حساب تفاعلات النطاقات في مرحلة المحول (transformer) النهائية واستخدام آلية تصفية لاستبعاد المرشحين غير المرجحين.

Andrea Maracani, Savas Ozkan, Junyi Zhu, Sinan Mutlu, Mete Ozay2026-04-23
💬 NLP

Not all ANIMALs are equal: metaphorical framing through source domains and semantic frames

تقدم هذه الورقة إطاراً حوسبياً جديداً يدمج بين المجالات المصدرية والأطر الدلالية لتحليل التأطير الاستعاري في الخطاب، كاشفاً عن كيفية توظيف الأيديولوجيات السياسية بشكل منهجي لظلال دلالية مختلفة ضمن الاستعارات ذاتها لتشكيل الفهم العام لقضايا مثل تغير المناخ والهجرة.

Yulia Otmakhova, Matteo Guida, Lea Frermann2026-04-23
🤖 machine learning

CHASM: Unveiling Covert Advertisements on Chinese Social Media

تقدم هذه الورقة البحثية CHASM، وهي مجموعة بيانات جديدة تضم ما يقرب من 5,000 إعلان خفي من واقع الحياة من منصة التواصل الاجتماعي الصينية "ريدنوت" (Rednote)، لتوضيح أن النماذج اللغوية الكبيرة متعددة الوسائط الحالية تعاني في اكتشاف هذه المنشورات الخادعة ولتسليط الضوء على الحاجة إلى تحسين آليات الضبط الدقيق والدفاع ضد هذا التهديد الناشئ.

Jingyi Zheng, Tianyi Hu, Yule Liu, Zhen Sun, Zongmin Zhang, Zifan Peng, Wenhan Dong, Xinlei He2026-04-23
💬 NLP

Effects of Cross-lingual Evidence in Multilingual Medical Question Answering

تبحث هذه الورقة في الإجابة على الأسئلة الطبية متعددة اللغات عبر اللغات ذات الموارد العالية والمنخفضة، كاشفةً أنه في حين تستفيد النماذج الأكبر وبيانات الويب المسترجعة باللغة الإنجليزية من اللغات ذات الموارد العالية، فإن اللغات ذات الموارد المنخفضة تحقق دقة مماثلة من خلال الجمع بين الاسترجاع باللغة الإنجليزية واللغة المستهدفة، مما يتحدى في النهاية الافتراض بأن المعرفة الخارجية تحسن الأداء بشكل عالمي ويسلط الضد على محدودية تغطية المصادر الطبية متعددة اللغات.

Anar Yeginbergen, Maite Oronoz, Rodrigo Agerri2026-04-23
💬 NLP

Aligning Stuttered-Speech Research with End-User Needs: Scoping Review, Survey, and Guidelines

تتناول هذه الورقة الفجوة بين الأبحاث الحالية المتعلقة بالتأتأة واحتياجات المستخدمين النهائيين من خلال الجمع بين مراجعة نطاقية واستطلاع لآراء أصحاب المصلحة لاقتراح تصنيف بحثي وإرشادات ملموسة لمواءمة التطوير التكنولوجي بشكل أفضل مع التجارب المعاشة للأشخاص الذين يعانون من التأتأة.

Hawau Olamide Toyin, Mutiah Apampa, Toluwani Aremu, Humaid Alblooshi, Ana Rita Valente, Gonçalo Leal, Zhengjun Yue, Zeer (…)2026-04-23