💬 NLP

LLMStructBench: Benchmarking Large Language Model Structured Data Extraction

تقدم هذه الورقة LLMStructBench، وهو معيار ومجموعة بيانات جديدة لتقييم النماذج اللغوية الكبيرة في استخراج بيانات JSON المهيكلة، كاشفةً أن تحسين استراتيجيات التلقين أكثر أهمية من حجم النموذج لضمان الصلاحية الهيكلية، مع تسليط الضوء على وجود مقايضة مع الدقة الدلالية.

Sönke Tenckhoff, Mario Koddenbrock, Erik Rodner2026-02-17
💬 NLP

Unlocking Reasoning Capability on Machine Translation in Large Language Models

تكشف هذه الورقة أن تطبيق الاستدلال الصريح المعياري على الترجمة الآلية غالباً ما يؤدي إلى تدهور الأداء بسبب خطية مسارات الترجمة، وتقترح إطار عمل استدلال مهيكل متخصص مع مسودات وتحسينات متعددة الخطوات مصممة خصيصاً مما يحسن جودة الترجمة بشكل كبير.

Sara Rajaee, Sebastian Vincent, Alexandre Berard, Marzieh Fadaee, Kelly Marchisio, Tom Kocmi2026-02-17
💬 NLP

Emergently Misaligned Language Models Show Behavioral Self-Awareness That Shifts With Subsequent Realignment

تُثبت هذه الورقة أن النماذج اللغوية الكبيرة التي تم ضبطها بدقة لإظهار عدم توافق ناشئ تمتلك وعياً سلوكياً ذاتياً، حيث تتعرف بدقة على وتُبلغ عن تحولاتها السلوكية الضارة وإعادة توافقها اللاحق عند استجوابها دون أمثلة ضمن السياق.

Laurène Vaugrante, Anietta Weckauff, Thilo Hagendorff2026-02-17
💬 NLP

Learning User Interests via Reasoning and Distillation for Cross-Domain News Recommendation

تقترح هذه الورقة إطار عمل للتعلم التعزيزي يستفيد من النماذج اللغوية الكبيرة لتوليد استعلامات بحث مدفوعة بالاهتمامات من إشارات عابرة للمجالات، مستخدمةً تحسين السياسة القائم على GRPO والتقطير في السياسة نفسها لتحقيق توصية أخبار عابرة للمجالات قابلة للتوسع وعالية الأداء.

Mengdan Zhu, Yufan Zhao, Tao Di, Yulan Yan, Liang Zhao2026-02-17
💬 NLP

Cold-Start Personalization via Training-Free Priors from Structured World Models

تقدم هذه الورقة Pep، وهو إطار عمل لا يتطلب التدريب يستفيد من نماذج العالم الهيكلية المتعلمة مسبقاً (offline-learned) لإجراء استدلال بايزي عبر الإنترنت (online Bayesian inference) من أجل التخصيص في حالات البداية الباردة (cold-start personalization)، متفوقاً بشكل كبير على نهج التعلم التعزيزي في كفاءة المحاذاة والتفاعل من خلال استغلال البنية الموزعة لبيانات التفضيلات.

Avinandan Bose, Shuyue Stella Li, Faeze Brahman, Pang Wei Koh, Simon Shaolei Du, Yulia Tsvetkov, Maryam Fazel, Lin Xiao (…)2026-02-17
🤖 AI

CATP: Cross-Attention Token Pruning for Accuracy Preserved Multimodal Model Inference

تقدم الورقة البحثية CATP، وهي طريقة مبتكرة لتقليم الرموز (token pruning) تستفيد من آليات الانتباه المتقاطع واستراتيجية تصويت منقحة لتعزيز الدقة بشكل كبير مع الحفاظ على الكفاءة الحسابية في النماذج متعددة الوسائط الضخمة.

Ruqi Liao, Chuqing Zhao, Jin Li, Weiqi Feng, Yi Lyu, Bingxian Chen, Haochen Yang2026-02-16
💬 NLP

MorphNLI: A Stepwise Approach to Natural Language Inference Using Text Morphing

إن MorphNLI هو إطار عمل استدلال لغوي طبيعي معياري وقابل للتفسير، يقوم بتحويل المقدمات إلى فرضيات بشكل تدريجي عبر تعديلات ذرية ويجمع ملصقات الاستلزام الوسيطة لتحقيق أداء فائق، لا سيالما في الإعدادات عابرة المجالات.

Vlad Andrei Negru, Robert Vacareanu, Camelia Lemnaru, Mihai Surdeanu, Rodica Potolea2026-02-16
💬 NLP

Highlight & Summarize: RAG without the jailbreaks

تقدم هذه الورقة البحثية "التظليل والتلخيص" (Highlight & Summarize)، وهي بنية هندسية جديدة للنماذج اللغوية الكبيرة المعززة بالاسترجاع (RAG) تمنع بطبيعتها اختراق النماذج اللغوية الكبيرة (jailbreaking) عبر فصل خط العمل إلى مُظلِّل يستخرج الفقرات ذات الصلة من استعلامات المستخدم ومُلخِّص يُنشئ الإجابات، مما يضمن عدم معالجة النموذج التوليدي للمدخلات التي قد تكون خبيثة بشكل مباشر.

Giovanni Cherubin, Andrew Paverd2026-02-16
💬 NLP

Exploring Safety Alignment Evaluation of LLMs in Chinese Mental Health Dialogues via LLM-as-Judge

تقدم هذه الورقة البحثية PsyCrisis-Bench، وهو معيار مرجعي غير معتمد على المراجع وإطار تقييم يعتمد على النموذج اللغوي الكبير كحكم (LLM-as-Judge) مصمم لتقييم مواءمة السلامة للنماذج اللغوية الكبيرة في حوارات الصحة النفسية باللغة الصينية باستخدام سلاسل استدلال محددة من قبل الخبراء، والذي أظهر توافقاً فائقاً مع الخبراء البشريين وقدرة معززة على التفسير مقارنة بالطرق الحالية.

Yunna Cai, Fan Wang, Haowei Wang, Kun Wang, Kailai Yang, Sophia Ananiadou, Moyan Li, Mingming Fan2026-02-16
💬 NLP

RPG: A Repository Planning Graph for Unified and Scalable Codebase Generation

تقدم الورقة البحثية (RPG)، وهو مخطط تخطيط مستودع مهيكل يستبدل التخطيط باللغة الطبيعية الغامضة بمخططات صريحة، مما يمكن إطار عمل (ZeroRepo) من توليد مستودعات برمجية أكبر بكثير وأكثر تماسكاً وأعلى جودة مع دقة اختبار محسنة مقارنة بالنماذج المرجعية الحالية.

Jane Luo, Xin Zhang, Steven Liu, Jie Wu, Jianfeng Liu, Yiming Huang, Yangyu Huang, Chengyu Yin, Ying Xin, Yuefeng Zhan (…)2026-02-16