🤖 machine learning

When Tables Leak: Attacking String Memorization in LLM-Based Tabular Data Generation

تكشف هذه الورقة أن طرق توليد البيانات الجدولية القائمة على النماذج اللغوية الكبيرة معرضة لتسريبات الخصوصية من خلال الأنماط الرقمية المحفوظة، وتقدم هجوماً للتحقق من العضوية بنظام الصندوق الأسود يسمى LevAtt لكشف هذه المخاطر، وتقترح استراتيجية جديدة لأخذ العينات عبر اضطراب الأرقام للتخفيف من التسريب بفعالية مع الحفاظ على فائدة البيانات.

Joshua Ward, Bochao Gu, Chi-Hua Wang, Guang Cheng2026-05-12
🤖 AI

RAG-HAR: Retrieval Augmented Generation-based Human Activity Recognition

يُعد RAG-HAR إطار عمل يعتمد على الاسترجاء المعزز ولا يتطلب تدريباً، حيث يسخر النماذج اللغوية الكبيرة وهندسة الأوامر المُحسّنة لتحقيق أداء رائد في التعرف على الأنشطة البشرية عبر معايير متنوعة، مع تمكين تحديد الأنشطة غير المرئية دون الحاجة إلى ضبط دقيق للنموذج أو مجموعات بيانات ضخمة موسومة.

Nirhoshan Sivaroopan, Hansi Karunarathna, Chamara Madarasingha, Anura Jayasumana, Kanchana Thilakarathna2026-05-12
🔬 materials science

A probabilistic framework for crystal structure denoising, phase classification, and order parameters

تقدم هذه الورقة إطاراً احتمالياً موحداً وقابلاً للتفاضل يقوم في آن واحد بإزالة الضجيج من التكوينات الذرية، وتصنيف الأطوار البلورية، وبناء معلمات النظام عبر التدريب على اضطرابات اصطناعية لنماذج أولية معروفة لتحليل المحاكاة الذرية المعقدة بمتانة تحت ظروف متنوعة.

Hyuna Kwon, Babak Sadigh, Sebastien Hamel, Vincenzo Lordi, John Klepeis, Fei Zhou2026-05-12
🤖 AI

Selective LoRA for Visual Tokens and Attention Heads

تقدم الورقة البحثية Image-LoRA، وهي طريقة لضبط المعلمات بكفاءة عالية تهدف إلى تكييف الرموز المرئية فقط ومجموعة فرعية مدمجة من مسارات القيم لرؤوس الانتباه، وذلك لتقليل التكاليف الحسابية مع الحفاظ على أداء النموذج الأساسي المجمد في النصوص النقية.

Tiange Luo, Lajanugen Logeswaran, Jaekyeom Kim, Justin Johnson, Honglak Lee2026-05-12
🤖 AI

LENS: LLM-Enabled Narrative Synthesis for Mental Health by Aligning Multimodal Sensing with Language Models

تقدم الورقة البحثية إطار عمل LENS، الذي يعمل على مواءمة بيانات المستشعرات متعددة الوسائط مع النماذج اللغوية الكبيرة عبر مشفر على مستوى الرقعة (patch-level encoder) ومجموعة بيانات ضخمة من النصوص والمستشعرات لتوليد سرديات صحة نفسية ذات دلالة سريرية، مما يمكّن النماذج اللغوية الكبيرة من التفكير بناءً على الإشارات السلوكية الخام لتحسين اتخاذ القرار السريري.

Wenxuan Xu, Arvind Pillai, Subigya Nepal, Amanda C Collins, Daniel M Mackin, Michael V Heinz, Tess Z Griffin, Nicholas C (…)2026-05-12
🤖 machine learning

DUALFloodGNN: Physics-informed Graph Neural Network for Operational Flood Modeling

تقدم الورقة البحثية DUALFloodGNN، وهي شبكة عصبية رسومية مبتكرة مستوحاة من الفيزياء تدمج القيود الفيزيائية على المستويين العالمي والمحلي للتنبؤ بسرعة ودقة بمتغيرات هيدرولوجية متعددة للنمذجة التشغيلية للفيضانات، متفوقة بذلك على مناهج الشبكات العصبية الرسومية الحالية مع الحفاظ على كفاءة حوسبية عالية.

Carlo Malapad Acosta, Herath Mudiyanselage Viraj Vidura Herath, Jia Yu Lim, Abhishek Saha, Sanka Rasnayaka, Lucy Marshal (…)2026-05-12
🤖 AI

Recursive Language Models

تقدم هذه الورقة النماذج اللغوية التكرارية (RLMs)، وهي نموذج لتوسيع نطاق الاستدلال يُمكّن النماذج اللغوية الكبيرة من تفكيك ومعالجة المطالبات الطويلة بشكل تعسفي برمجياً وبشكل تكراري، مما يحقق أداءً يتفوق بشكل كبير على الأساليب الحالية للسياقات الطويلة والنماذج الرائدة مع الحفاظ على تكاليف مماثلة.

Alex L. Zhang, Tim Kraska, Omar Khattab2026-05-12
🤖 AI

Spectral Characterization and Mitigation of Sequential Knowledge Editing Collapse

تقدم هذه الورقة البحثية إطار عمل REVIVE، وهو إطار عمل جاهز للاستخدام (plug-and-play) يعمل على التخفيف من حدة الانهيار الكارثي في تحرير المعرفة المتسلسل عبر استخدام التحليل الطيفي لتحديد والحفاظ على الفضاء الجزئي المنفرد المهيمن للأوزان مسبقة التدريب، مما يحافظ على كل من فعالية التحرير وأداء النموذج العام حتى بعد آلاف عمليات التحرير.

Chi Zhang, Mengqi Zhang, Xiaotian Ye, Runxi Cheng, Zisheng Zhou, Ying Zhou, Pengjie Ren, Zhumin Chen2026-05-12
🤖 machine learning

Knowledge is Not Enough: Injecting RL Skills for Continual Adaptation

تقترح الورقة البحثية "نقل المهارة البارامتري" (PaST)، وهو إطار عمل يعالج أوجه القصور في الضبط الدقيق الخاضع للإشراف في تكييف النماذج اللغوية الكبيرة من خلال الحقن الخطي لمتجهات مهارات غير مرتبطة بنطاق محدد مستمدة من التعلم التعزيزي، مما يتيح تكيفاً مستمراً فعالاً ومؤثراً لدمج المعرفة والاستخدام الوكيل للأدوات.

Pingzhi Tang, Yiding Wang, Muhan Zhang2026-05-12
🤖 AI

A Scalable Entity-Based Framework for Auditing Bias in LLMs

تقدم هذه الورقة إطار عمل قائمًا على الكيانات وقابلًا للتوسع لتدقيق التحيز في النماذج اللغوية الكبيرة، يستفيد من البيانات الاصطناعية لإجراء أكبر دراسة حتى الآن (1.9 مليار نقطة بيانات)، كاشفةً عن تفاوتات منهجية مثل المحاباة السياسية والجغرافية التي تستمر رغم الضبط التوجيهي وتتفاقم مع زيادة حجم النموذج.

Akram Elbouanani, Aboubacar Tuo, Adrian Popescu2026-05-12