💬 NLP

Large Language Model as Token Compressor and Decompressor

تقدم هذه الورقة إطار عمل ترميز تلقائي ذاتي التعبير يقوم بضبط نموذج لغوي كبير مُدرب مسبقاً لضغط النصوص الطويلة إلى رموز كامنة منفصلة مدمجة ومتكيفة مع المحتوى (Z-tokens) وإعادة بنائها بدقة، مما يحقق تقليلاً في عدد الرموز يصل إلى 18 ضعفاً مع الحفاظ على الدقة وتمكين الاستنتاج الفعال للسياقات الطويلة.

Wenbing Li, Zikai Song, Jielei Zhang, Tianhao Zhao, Junkai Lin, Yiran Wang, Wei Yang2026-03-27
💬 NLP

Supercharging Federated Intelligence Retrieval

تقترح هذه الورقة نظام استرجاع معزز بالتوليد (RAG) اتحادياً وآمناً يستفيد من منصة Flower والحوسبة السرية لتمكين الاسترجاع المحلي والاستدلال الخاص عبر نماذج اللغات الكبيرة (LLM) عن بُعد عبر صوامع البيانات الموزعة، مع تقديم نهج استدلال متتالي لدمج النماذج الخارجية غير السرية دون المساس بخصوصية البيانات.

Dimitris Stripelis, Patrick Foley, Mohammad Naseri, William Lindskog-Münzing, Chong Shen Ng, Daniel Janes Beutel, Nichol (…)2026-03-27
💬 NLP

Synchronous Signal Temporal Logic for Decidable Verification of Cyber-Physical Systems

تقدم هذه الورقة البحثية المنطق الزمني الإشاري المتزامن (SSTL)، وهو جزء قابل للتقرير من المنطق الزمني الإشاري، يستفيد من فرضية الثبات الإشاري والترجمة إلى LTLPLTL_P لتمكين التحقق الاستاتيكي من خصائص السلامة والحيوية في الأنظمة السيبرانية الفيزيائية، كما هو موضح في نموذج لقلب بشري.

Partha Roop, Sobhan Chatterjee, Avinash Malik, Nathan Allen, Logan Kenwright2026-03-27
💬 NLP

PICon: A Multi-Turn Interrogation Framework for Evaluating Persona Agent Consistency

تقدم هذه الورقة PICon، وهو إطار عمل للاستجواب متعدد الجولات يقيم الاتساق الداخلي والخارجي واتساق إعادة الاختبار لوكلاء الشخصيات القائمين على النماذج اللغوية الكبيرة، مما يكشف أن الأنظمة المتقدمة حتى تفشل في مطابقة المعايير البشرية عند إخضاعها لاستجواب منطقي متسلسل.

Minseo Kim, Sujeong Im, Junseong Choi, Junhee Lee, Chaeeun Shim, Edward Choi2026-03-27
💬 NLP

Beyond Via: Analysis and Estimation of the Impact of Large Language Models in Academic Papers

تحلل هذه الورقة التحولات في الكتابة الأكاديمية الناتجة عن النماذج اللغوية الكبيرة، كاشفةً عن تغيرات متميزة في أنماط استخدام الكلمات، وصعوبة تصنيف أصول نماذج معينة بسبب التشابه الأسلوبي، والطبيعة غير المتجانسة والديناميكية لتبني النماذج اللغوية الكبيرة في البحث العلمي.

Mingmeng Geng, Yuhang Dong, Thierry Poibeau2026-03-27
💬 NLP

Measuring What Matters -- or What's Convenient?: Robustness of LLM-Based Scoring Systems to Construct-Irrelevant Factors

تُظهر هذه الدراسة أن نظام تسجيل يعتمد على نماذج لغوية كبيرة ذي بنية مزدوجة لاختبارات الحكم الموقفي يتميز عمومًا بالمتانة تجاه العوامل غير ذات الصلة بالبناء، مثل النصوص التي لا معنى لها، والأخطاء الإملائية، ورقي الكتابة، رغم أنه يعاقب بشكل مناسب الاستجابات الخارجة عن الموضوع وتكرار النصوص.

Cole Walsh, Rodica Ivan2026-03-27
💬 NLP

LEVOS: Leveraging Vocabulary Overlap with Sanskrit to Generate Technical Lexicons in Indian Languages

تقترح الورقة البحثية LEVOS، وهو نهج مبتكر يستفيد من التجزئة على مستوى الحروف القائمة على اللغة السنسكريتية ونموذج المحولات (Transformer) لتحسين ترجمة المصطلحات التقنية إلى اللغات الهندية ذات الموارد المنخفضة، محققاً مكاسب كبيرة في الأداء ومعززاً إمكانية الوصول التعليمي.

Karthika N J, Krishnakant Bhatt, Ganesh Ramakrishnan, Preethi Jyothi2026-03-26
💻 computer science

Inspection and Control of Self-Generated-Text Recognition Ability in Llama3-8b-Instruct

تُثبت هذه الورقة أن نموذج Llama3-8b-Instruct يمكنه التعرف بشكل موثوق على نصوصه المولدة من خلال الاستفادة من متجه سببي محدد في المجرى المتبقي (residual stream) يشفر "التأليف الذاتي"، وتُظهر أن التلاعب بهذا المتجه يسمح بالتحكم المباشر في كل من ادعاءات التأليف الخاصة بالنموذج وإيمانه بكتابة نصوص عشوائية.

Christopher Ackerman, Nina Panickssery2026-03-26
💬 NLP

Phrase-Instance Alignment for Generalized Referring Segmentation

تقترح هذه الورقة إطار عمل جديداً يعتمد على الوعي بالنماذج الفردية (instance-aware) لمهام التجزئة المرجعية المعممة (Generalized Referring Segmentation)، حيث تعيد صياغة المهمة كعملية محاذاة بين العبارة والنموذج باستخدام فقدان المحاذاة بين العبارة والكائن (Phrase-Object Alignment loss) وآلية تجميع موحدة، محققةً أداءً هو الأفضل في فئته (state-of-the-art) على معايير gRefCOCO وRef-ZOM من خلال التعامل بفعالية مع سيناريوهات الهدف الفردي، والمتعدد، والعدمي.

E-Ro Nguyen, Hieu Le, Dimitris Samaras, Michael S. Ryoo2026-03-26
💬 NLP

Evaluation of Large Language Models via Coupled Token Generation

تقترح هذه الورقة إطاراً سببياً لـ "توليد الرموز المقترن" الذي يعمل على مزامنة العشوائية عبر النماذج اللغوية الكبيرة لتمكين إجراء اختبارات قياسية أكثر كفاءة، وتكشف أن تصنيفات التقييم القياسية يمكن أن تتعرض لتشوه كبير بسبب العشوائية غير المنضبطة في التوليد.

Nina Corvelo Benz, Stratis Tsirtsis, Eleni Straitouri, Ivi Chatzi, Ander Artola Velasco, Suhas Thejaswi, Manuel Gomez-Ro (…)2026-03-26