💬 NLP

RedditPersona: A Modular Framework for Community-Conditioned LLM Adaptation from Reddit

تقدم الورقة البحثية RedditPersona، وهو إطار عمل معياري يوحد عمليات جمع البيانات، وتوصيف المستخدمين، والتقييم من أجل تكييف النماذج اللغوية الكبيرة مع المجتمعات المشروطة، حيث أثبتت من خلال تجارب على 112 من مجتمعات "ريديت" (subreddits) المتعلقة بالرفاهية الحضرية أن قابلية تحديد الهوية السلوكية تتوافق مع الاتفاق بين الاستراتيجية والمجتمع، بينما تكشف عن مقايضة ثابتة بين قابلية تحديد الهوية والتشابه التوزيعي للنصوص.

Amirhossein Ghaffari, Ali Goodarzi, Huong Nguyen, Simo Hosio, Lauri Lovén, Ekaterina Gilman2026-08-13
🤖 AI

Distribird: Literature-Informed Prior Distribution Design for Bayesian Model Calibration

يُعد Distribird تطبيق ويب وكيلًا (agentic) يعمل على أتمتة إنشاء التوزيعات المسبقة المستندة إلى الأدبيات العلمية لمعايرة النماذج البايزية، وذلك عبر نشر مسار عمل متعدد الوكلاء للبحث عن البيانات واستخراجها وملاءمتها إحصائيًا من الأوراق العلمية، مما يوفر بديلًا شفافًا يُدار محليًا للتوزيعات المسبقة المنتظمة يضمن إمكانية التتبع ويمنع المخرجات غير المستندة إلى أساس.

Patrik P. Süli, György Eigner, Roland Hollós2026-08-13
🤖 AI

MaSRead: Content-Addressed Reading of Replicated Latent Stores

تُمكِّن تقنية MasRead الوكلاء المستقلين من استرجاع أجزاء محددة بشكل موثوق من مخزن كامن مكرر خالٍ من التعارض عبر توجيه الاستعلامات من خلال مجموعات وسوم مشتقة من المحتوى وفك تشفير الأجزاء المختارة تحت قناع انتباه صارم، مما يتغلب على مشكلات التداخل الناتجة عن التوضع المشترك ويسمح بالقراءة الموجهة بالمحتوى وقابلة للتوسع بغض النظر عن حجم المخزن أو ترتيب التسليم.

Carlos Baquero, Luís Brito, João Resende2026-08-13
🤖 AI

From Monolithic to Modular: Segment-level Automatic Prompt Optimization

تقدم هذه الورقة SAPO، وهي طريقة تحسين تلقائي للمطالبات على مستوى القطع تعمل على تفكيك المطالبات إلى مكونات متميزة لاستهداف نقاط ضعف محددة، وتتفوق على النهج الموحدة الحالية عبر مختلف المعايير.

Nikita Kulin, Viktor Zhuravlev, Artur Khairullin, Sergey Muravyov, Ilya Makarov, Daniil Sukhorukov, Ekaterina Averkova2026-08-13
🤖 AI

Identity from the Outside: A Conceptual Framework and Research Program for AI Personality Clones

تقترح هذه الورقة إطاراً مفاهيمياً لنسخ الشخصية القائمة على الذكاء الاصطناعي تعيد من خلاله تعريف الهوية الشخصية عبر عدم التمييز التشغيلي والوفاء المناخي، مقدمةً نموذج تحليل سداسي الحدود ونموذج "المندوب" لتجادل بأن النسخة الأكثر أصالة على المدى الطويل هي تلك التي تتباعد عن الأصل بنفس الطريقة التي كان سيتطور بها الأصل نفسه.

Luc E. Brunet2026-08-13
🤖 AI

Forecasting Side Effects of Activation Steering

تُثبت هذه الورقة أنه بينما يتسبب توجيه التنشيط في النماذج اللغوية في كثير من الأحيان في آثار جانبية غير مقصودة وهيكلية وغير متماثلة على سلوكيات أخرى، إلا أنه يمكن التنبؤ بهذه الآثار بدقة قبل التطبيق من خلال تحليل تمثيلات النموذج غير الموجهة، مما يتيح التدقيق الاستباقي للسلامة والنشر الأكثر أماناً.

Chong Yong Ong, Alson Wei Jie Sim, Peixin Zhang, Jun Sun2026-08-13
🤖 AI

LinearKV: One Cached State Suffices for Position-Independent Caching in Hybrid LLMs

تقدم الورقة البحثية LinearKV، وهو إطار عمل لا يتطلب تدريباً يتيح التخزين المؤقت المستقل عن الموضع في النماذج اللغوية الكبيرة الهجينة، من خلال إثبات أن تهيئة طبقات التكرار الخطي بحالة مخزنة واحدة هي أكثر فعالية وكفاءة من التركيب الدقيق جبرياً لجميع الحالات المخزنة المستخدمة في الطرق المتزامنة.

Yirui Liu, Ruoling Qi, Longwen Wang, Xuaner Wu, Jian Chen, Yuxin Jin, Jiawei Shao, Xuelong Li2026-08-13
💬 NLP

Backtrader-Bench: Benchmarking LLM Agents on Algorithmic Trading with Self-Generated MCQs

تقدم الورقة البحثية Backtrader-Bench، وهو إطار عمل مبتكر لتقييم وكلاء البرمجة القائمين على النماذج اللغوية الكبيرة في التداول الخوارزمي من خلال أسئلة متعددة الخيارات ذاتية التوليد ومحققة برمجياً، مما يثبت أن الوكلاء المعززين بالأدوات يتفوقون بشكل كبير على النماذج المرجعية غير المعززة بالأدوات مع تأسيس بنية تحتية قابلة للتوسع للتدريب المستقبلي باستخدام التعلم التعزيزي.

Ruoxi Zhao, Maziar Raissi2026-08-13
🤖 AI

InfraBench: Evaluating Infrastructure Agents Across Layers, Lifecycle, and Risk

تقدم الورقة البحثية InfraBench، وهي مجموعة اختبار شاملة لتقييم وكلاء الذكاء الاصطناعي في مهام البنية التحتية الواقعية عبر كامل مكدس النظام ودورة الحياة التشغيلية، كاشفةً أن حتى النماذج الأعلى أداءً تعاني مع الموثوقية المعقدة وطويلة الأمد، وغالباً ما تترك وراءها آثاراً جانبية غير آمنة أو ثوابت مكسورة.

Yuan Gao (Wanxiang), Zeren Yang (Wanxiang), Junnan Li (Wanxiang), Shawn (Wanxiang), Zhong, Ahmed Dajani, Mai Zheng, An (…)2026-08-13
🤖 AI

CORA-Diff: Confidence-Oriented Residual Acceptance for Efficient Diffusion Language Model Inference

تُعد CORA-Diff طريقةً لا تتطلب تدريباً تعمل على تسريع استنتاج نماذج اللغات الانتشارية (Diffusion Language Models) عبر استخدام إشارات الثقة والاستمرارية الأصلية لقبول الرموز المستقرة مبكراً، مما يقلل وقت التشغيل بشكل كبير مع الحفاظ على أداء المهام دون تعديل الهيكل الأساسي للنموذج.

Yifan Wu, Yufeng Zhang, Kenli Li2026-08-13